Skip to main content

doc-ocr

文档文字识别。用户提供 PDF/扫描件/图片(合同、发票、书页、截图),需要提取文字、转成可编辑文本时使用。扫描件自动 OCR(macOS Vision,中英文)。Document OCR: extract editable text from PDFs, scans, and images (contracts, invoices, book pages, screenshots) via macOS Vision.

설치로 이동

소스 정보

저장소
davepoon/buildwithclaude
최근 소스 활동
2026년 8월 21일 06:58
감지된 SKILL.md 언어
중국어
스타
3,512
포크
520

설치 방법

기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.

소스 파일 검토

설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.

파일 탐색기
2 개 파일

SKILL.md 표시 중

SKILL.md
소스 지침 · 읽기 전용 미리보기
name
doc-ocr
description
文档文字识别。用户提供 PDF/扫描件/图片(合同、发票、书页、截图),需要提取文字、转成可编辑文本时使用。扫描件自动 OCR(macOS Vision,中英文)。Document OCR: extract editable text from PDFs, scans, and images (contracts, invoices, book pages, screenshots) via macOS Vision.
category
document-processing
license
MIT
# Doc-OCR 文档文字识别 PDF / 扫描件 / 图片 → 可编辑文字。有文字层的 PDF 直接提取,扫描件自动 OCR(macOS Vision 自带,中英文)。 ## 触发条件 用户提供 PDF/图片文件,要求: - "提取文字""转文字""OCR" - 处理扫描件、合同、发票、书页、截图 ## 使用步骤 ### 1. 单个文件 ```bash python3 scripts/dococr.py 合同.pdf python3 scripts/dococr.py 发票.jpg ``` 输出保存为 `<输入名>_ocr.txt`。 ### 2. 批量目录 ```bash python3 scripts/dococr.py ./扫描件/ -o 全部.txt ``` ### 3. Markdown 输出 ```bash python3 scripts/dococr.py 书.pdf --md ``` ## 依赖(首次使用时安装) ```bash pip3 install pymupdf pyobjc-framework-Vision ``` **注意**:OCR 依赖 macOS Vision(仅 macOS 可用)。Linux 需另装 tesseract 等引擎。 ## 已知陷阱 - **扫描件判定**:PDF 文字层 <20 字自动走 OCR,正常 PDF 直接提取。 - **手写体**:Vision 对印刷体/清晰手写效果好,潦草手写不保证。 - **隐私卖点**:文件在本机处理,不上传第三方。
GitHub에서 보기