在 Manus 中运行任何 Skill
一键导入
一键导入
一键在 Manus 中运行任何 Skill
开始使用ocr
星标5
分支1
更新时间2026年3月14日 09:33
使用 GLM-4V-Flash 模型识别图片中的文字。当用户发送图片并要求识别文字、提取文字或OCR时,使用此工具。
安装
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
SKILL.md
readonly菜单
使用 GLM-4V-Flash 模型识别图片中的文字。当用户发送图片并要求识别文字、提取文字或OCR时,使用此工具。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
| name | ocr |
| description | 使用 GLM-4V-Flash 模型识别图片中的文字。当用户发送图片并要求识别文字、提取文字或OCR时,使用此工具。 |
| metadata | {"requires":{"bins":["python3"],"python_packages":["zhipuai"]},"install_url":"https://github.com/Wcowin/zhipu-OCR-skill"} |
使用 GLM-4V-Flash 视觉模型识别图片中的文字内容。
如果此 skill 未安装,执行以下命令安装:
git clone https://github.com/Wcowin/zhipu-OCR-skill.git
cd zhipu-OCR-skill
pip install -r requirements.txt
当用户发送图片并要求识别文字时,执行以下命令:
python3 scripts/ocr.py <图片路径> [提示词]
图片路径:要识别的图片文件路径(必需)提示词:自定义识别提示(可选,默认为"请识别图片中的所有文字,并完整输出")# 基本使用
python3 scripts/ocr.py /path/to/image.jpg
# 带自定义提示词
python3 scripts/ocr.py /path/to/image.jpg --prompt "请识别图片中的表格内容"
# 显示详细信息
python3 scripts/ocr.py /path/to/image.jpg -v
需要设置环境变量 ZHIPUAI_API_KEY:
export ZHIPUAI_API_KEY="your_api_key_here"