用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/void2anything/qingagent --skill image-reading命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
正在显示 SKILL.md
| name | image-reading |
| label | 看图片 |
| summary | 识别图片内容与文字 |
| icon | vision |
| description | 识别、描述或提取用户提供的单张图片内容。用户上传图片、给出图片链接、给出 fileId,或要求 OCR/看图分析/图片转文字/描述图片时使用。 |
| user-invocable | true |
| placeholder | 上传图片或说明 |
| config | vision-provider |
| tools | ["readImage"] |
| metadata | {"category":"capability"} |
你可以调用 readImage 读取用户提供的单张图片,把识别结果作为文字返回后再继续写作或回答。
不要用于生成图片、改图、制作插图;这些场景使用其他工具。
image 传什么image。filePath(/api/v1/files/<id>/<name>)或裸 fileId。readDraft 读到该图片块,取它的 src(可能是 /api/v1/files/...、http(s) 或 data:image/...;base64,...),原样传给 image。materialId 传给 image,工具会自动取该素材的原始图片字节(非图片素材会报错)。docs +media-download)把图片下载到工作区,再用 read_file 以 encoding:"base64" 读出,拼成 data:image/<类型>;base64,<内容> 传给 image。调用 readImage:
image: 见上面五类来源,传对应的 URL / 路径 / fileId / materialId / data URL。prompt: 本次识别任务指令。写清楚要提取什么,例如"请提取图片中的中文文字并保留换行"。includeConversation: 默认不传或传 false;只有图片含义必须结合最近对话才看得懂时传 true。工具返回:
ok: true 时,text 是识别结果。基于它继续回答用户。ok: false 时,error 是失败原因。若提示"图像识别副基模未配置",请让用户到"设置 → 技能 → 图像识别"填写多模态模型 API key。