用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/cas-bigdatalab/piflow --skill pdf-text-extract命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
正在显示 SKILL.md
基于 SOC 职业分类
| name | pdf_text_extract |
| description | 从PDF文件中提取文本内容,保存为txt文件。当用户需要从PDF中提取文字时使用此skill。 |
| license | Proprietary. LICENSE.txt has complete terms |
| name_zh | 从PDF文件中提取文本内容,保存为txt文件算子 |
| input_params | [{"name":"input_path","type":"string","required":true,"description":"输入PDF文件路径"},{"name":"output_path","type":"string","required":true,"description":"输出txt文件路径"},{"name":"pages","type":"string","required":false,"description":"页码范围,如\"1-3,5\"(可选,默认全部页面)"}] |
| output_params | [{"name":"output_path","type":"text_file","description":"提取的文本文件(.txt)"}] |
| tag | 数据解析 |
| publisher | COMMUNITY |
该技能从PDF文件中提取文本内容,保存为txt文件,适用于需要从PDF中提取可编辑文本的场景。
python scripts/run_pdf_text_extract.py --input_path <输入PDF> --output_path <输出TXT> [--pages <页码范围>]
| 参数 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
| input_path | string | 是 | - | 输入PDF文件路径 |
| output_path | string | 是 | - | 输出txt文件路径 |
| pages | string | 否 | 全部 | 页码范围,如"1-3,5" |
python scripts/run_pdf_text_extract.py --input_path document.pdf --output_path text.txt
python scripts/run_pdf_text_extract.py --input_path document.pdf --output_path text.txt --pages "1-10"
--- Page 1 ---
这是第一页的文本内容...
--- Page 2 ---
这是第二页的文本内容...