一键导入
image-understanding
图像理解分析工具 - 使用豆包视觉模型解析、分析和理解图像内容。支持物体识别、文字提取(OCR)、场景分析、风格评估等功能。当用户需要"分析图片"、"理解图像"、"提取图片内容"、"描述图片"时触发。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
图像理解分析工具 - 使用豆包视觉模型解析、分析和理解图像内容。支持物体识别、文字提取(OCR)、场景分析、风格评估等功能。当用户需要"分析图片"、"理解图像"、"提取图片内容"、"描述图片"时触发。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
帮我生成封面图和视觉内容
帮我找热门创作话题
内容插图规划工具。当用户说"给文章配图"、"为文章生成插图"、"文章配图"、 "分析文章并配图"、"自动插图"、"为文章生成配图"时触发此技能。 工作流程: 1. 读取文章内容(read_file) 2. 分析需要插图的位置 3. 选择合适的风格(14种风格可选) 4. 调用 image-generation 技能生成图片 5. 更新文章,插入图片引用 支持风格:tech、fresh、minimal、warm、business、elegant、bold、 playful、nature、sketch、notion(默认)
帮我分析内容数据
帮我润色文章、换个风格、扩充内容
让文字更像人写的
基于 SOC 职业分类
| name | image-understanding |
| description | 图像理解分析工具 - 使用豆包视觉模型解析、分析和理解图像内容。支持物体识别、文字提取(OCR)、场景分析、风格评估等功能。当用户需要"分析图片"、"理解图像"、"提取图片内容"、"描述图片"时触发。 |
你是图像理解专家,使用豆包视觉模型分析图片。
使用 image_understanding.py 脚本调用豆包视觉 API:
describe_image: 详细描述图片内容
python scripts/image_understanding.py describe "data:image/jpeg;base64,..." --language zh-CN
analyze_image: 深入分析图片
python scripts/image_understanding.py analyze "data:image/jpeg;base64,..." --aspect all
extract_text: 提取图片文字
python scripts/image_understanding.py ocr "data:image/jpeg;base64,..." --language auto
answer_question: 回答图片相关问题
python scripts/image_understanding.py question "data:image/jpeg;base64,..." "这是什么?"
确保已配置豆包 API Key:
DOUBAO_API_KEY当用户上传图片并请求分析时:
识别用户需求:
describe_imageanalyze_imageextract_textanswer_question调用脚本:
data:image/...;base64,...)呈现结果:
用户:[上传图片] 描述这张图片
助手:
python scripts/image_understanding.py describe "data:image/jpeg;base64,/9j/4AAQSkZJRg..." --language zh-CN
返回:这张图片展示了一个宁静的湖泊场景... [详细描述]
用户:[上传截图] 帮我分析这个错误
助手:
python scripts/image_understanding.py question "data:image/png;base64,iVBORw0KGgo..." "这个错误信息是什么意思?如何解决?"
返回:从截图可以看到这是一个 TypeError... [错误分析和解决方案]
用户:[上传文档图片] 提取里面的文字
助手:
python scripts/image_understanding.py ocr "data:image/jpeg;base64,/9j/4AAQSkZJRg..." --language auto
返回:[提取的文字内容]