用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/egbertie/satisficing-institute --skill pdf-document-parser命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
生产级AI会议笔记处理系统。支持多种输入格式,智能提取行动项、责任人、截止时间,自动生成结构化会议纪要和TODO清单。具备准确性自检、局限标注、鲁棒性测试等生产级特性。
A/B测试生成器 - 生成可测试的文案/设计变体: 1. 全局考虑:覆盖标题、CTA、说服角度等测试维度 2. 系统考虑:元素选择→变体生成→测试设计→结果分析闭环 3. 迭代机制:根据测试结果优化变体生成策略 4. Skill化:标准接口,可按维度独立生成 5. 流程自动化:自动生成测试方案和变体
学术级深度研究标准Skill - 满足5个标准: 1. 全局考虑:六层模型全覆盖(范式→情报→证据→多维→逻辑→迭代) 2. 系统考虑:研究设计→执行→验证→报告完整闭环 3. 迭代机制:三轮自我修正循环,持续优化研究质量 4. Skill化:标准SKILL.md格式,可安装可调用 5. 流程自动化:六层检查自动执行,质量门控自动验证
基于 SOC 职业分类
正在显示 SKILL.md
| name | pdf-document-parser |
| version | 1.0.0 |
| description | PDF文档解析自动化机制 - 基于MinerU API的文档解析Skill 核心价值:自动提交PDF解析任务、轮询结果、下载结构化输出 适用:论文解析、文档归档、批量处理 |
| author | OpenClaw |
| tags | ["pdf","parser","mineru","automation"] |
| requires | [{"model":"kimi-coding/k2p5"},{"local_tools":["curl","jq","unzip"]},{"env":["MINERU_TOKEN"]},{"cron":true}] |
| 类型 | 格式 | 支持状态 |
|---|---|---|
| ✅ 完全支持 | ||
| Word | .docx | ✅ 完全支持 |
| PPT | .pptx | ✅ 完全支持 |
| 图片 | .jpg, .png | ✅ OCR支持 |
| 功能 | 说明 | 默认启用 |
|---|---|---|
| 公式识别 | LaTeX格式输出 | ✅ |
| 表格识别 | 结构化表格 | ✅ |
| OCR | 多语言文字识别 | ✅ |
| 版面分析 | 多栏/图文混排 | ✅ |
文档提交 → 任务创建 → 状态轮询 → 结果下载 → 解压归档 → 质量检查
| 错误类型 | 处理方式 | 重试策略 |
|---|---|---|
| 网络超时 | 指数退避重试 | 3次 |
| 解析失败 | 记录失败原因 | 手动重试 |
| 文件损坏 | 跳过并告警 | 无 |
| 阶段 | 动作 | 频率 |
|---|---|---|
| Plan | 生成批量解析计划 | 按需 |
| Do | 执行解析任务 | 自动 |
| Check | 检查解析质量 | 每任务 |
| Act | 优化解析参数 | 每周 |
V1.0.0: 基础解析
↓
V1.1.0: 智能参数选择(根据文档类型)
↓
V1.2.0: 批量队列管理
skills/pdf-document-parser/
├── SKILL.md # 本文件
├── _meta.json # 元数据
├── config/
│ └── mineru.yaml # API配置
├── scripts/
│ ├── parse_single.sh # 单文档解析
│ ├── parse_batch.sh # 批量解析
│ └── poll_result.sh # 结果轮询
└── cron.d/
└── pdf-parser.cron # 定时任务配置
# 单文档解析
./scripts/parse_single.sh <pdf_url> [output_dir]
# 批量解析
./scripts/parse_batch.sh <urls_file> [output_dir]
# 查询任务状态
./scripts/poll_result.sh <task_id>
| 阶段 | 自动动作 | 输出 |
|---|---|---|
| 提交 | 调用MinerU API创建任务 | task_id |
| 轮询 | 每30秒检查状态 | 状态更新 |
| 完成 | 自动下载结果ZIP | 结构化数据 |
| 解压 | 自动解压到指定目录 | Markdown+图片 |
| 检查 | 验证输出完整性 | 质量报告 |
# 批量解析队列处理(每5分钟)
*/5 * * * * /bin/bash /root/.openclaw/workspace/skills/pdf-document-parser/scripts/process_queue.sh
# 失败任务重试(每小时)
0 * * * * /bin/bash /root/.openclaw/workspace/skills/pdf-document-parser/scripts/retry_failed.sh
# 1. 设置API密钥
export MINERU_TOKEN="your_api_key"
# 2. 单文档解析
./scripts/parse_single.sh "https://arxiv.org/pdf/2410.17247" ./output/
# 3. 批量解析(urls.txt每行一个URL)
./scripts/parse_batch.sh urls.txt ./batch_output/
output/
├── full.md # 完整Markdown
├── content_list.json # 结构化内容
├── images/ # 提取的图片
└── layout.json # 版面分析
| 标准 | 验证项 | 状态 |
|---|---|---|
| 1. 全局 | 4种文档类型 + 4项解析功能 | ✅ |
| 2. 系统 | 完整解析流程 + 错误处理 | ✅ |
| 3. 迭代 | PDCA闭环 + 版本升级 | ✅ |
| 4. Skill化 | 标准结构 + 可调用接口 | ✅ |
| 5. 自动化 | 全自动流程 + cron任务 | ✅ |
版本: v1.0.0
创建: 2026-03-20
标准: 5个标准全部满足