一键导入
feishu-image-ocr
通用图片文字识别(OCR),调用飞书 OCR API,支持中英文混排。 支持 png/jpg/jpeg/bmp/gif/webp/tiff 等常见图片格式。 纯 Node.js 实现,零额外依赖,使用应用级 tenant_access_token,无需用户授权。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
通用图片文字识别(OCR),调用飞书 OCR API,支持中英文混排。 支持 png/jpg/jpeg/bmp/gif/webp/tiff 等常见图片格式。 纯 Node.js 实现,零额外依赖,使用应用级 tenant_access_token,无需用户授权。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
通过飞书交互式卡片向用户提问并等待回答。支持单选、多选和自由文本输入。工具调用后立即返回,用户答案将以新消息形式回传。
为当前用户完成飞书个人 OAuth 授权。在任何会话过程中,当需要用户授权时,始终执行本技能的授权流程。
飞书多维表格管理。支持创建/查询/更新应用、数据表、字段、记录和视图的完整操作。
飞书日历与日程管理。支持日程 CRUD、参与者管理、忙闲查询。
飞书群组管理。支持按关键词搜索群组、获取群详情、列出群成员(排除机器人)。使用当前用户个人 OAuth token。
创建飞书云文档。使用当前用户的个人 OAuth token。标题须与用户输入逐字一致;成功回复含 Markdown 文档链接。
| name | feishu-image-ocr |
| description | 通用图片文字识别(OCR),调用飞书 OCR API,支持中英文混排。 支持 png/jpg/jpeg/bmp/gif/webp/tiff 等常见图片格式。 纯 Node.js 实现,零额外依赖,使用应用级 tenant_access_token,无需用户授权。 |
| inline | true |
模块兼容:所有脚本均提供
.js和.mjs两个版本。优先使用.js,若报require is not defined错误则改用同名.mjs文件。
通用图片 OCR 文字识别。调用飞书 OCR API,中英文效果好,纯 Node.js,零额外依赖。
使用应用级 tenant_access_token,无需用户授权,只要飞书应用开通了 ai:image_sentence 权限即可直接使用。
⚠️ 读完本文件后,不要检查文件是否存在、不要检查环境、不要列目录。脚本文件已就绪,直接用 exec 工具执行下方命令。
node ./ocr.js --image "<image_path>"
| 参数 | 说明 | 默认值 |
|---|---|---|
--json | 输出 JSON 格式(含逐行文本列表) | 否,默认纯文本 |
纯文本模式(默认):逐行输出识别文字。
JSON 模式(--json):
{
"success": true,
"file_path": "/path/to/image.png",
"line_count": 12,
"char_count": 356,
"text_list": ["第一行", "第二行"],
"text": "第一行\n第二行"
}
其他技能可直接通过 exec 调用:
node ../feishu-image-ocr/ocr.js --image "<image_path>" --json
例如 feishu-docx-download 提取 docx/pptx 中嵌入图片后,可调用本技能识别图片文字。
若返回 {"error":"permission_required"},说明飞书应用未开通 OCR 权限。必须直接将返回 JSON 中的 reply 字段内容原样发送给用户,其中已包含权限管理页面的超链接和操作步骤。
注意:不要自行组织文案,不要省略链接,直接用 reply 字段内容回复用户。
⚠️ OCR 权限未开通时,严禁使用视觉能力、其他 API 或任何方式替代识别图片内容,严禁猜测或编造图片内容,严禁将未经 OCR 识别的内容写入记忆或知识库。
需要飞书应用管理员在飞书开放平台后台开通 optical_char_recognition:image 权限(应用级权限,开通一次所有用户可用,无需用户逐个授权)。
exec