원클릭으로
pdf-ai-explorer
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
SOC 직업 분류 기준
当用户要启动 agentic loop、使用 one-click auto、通过 Python API 调用完整流程、或在运行过程中接收 callback 和 heartbeat 事件时使用此 skill。如果用户当前主要是在准备或维护 `.xdev` 数据,先转到 xdev skill。
当用户要求更新 extract-agent 版本号、补 changelog、构建 dist、推送代码、或发布到 PyPI 时使用此 skill。只用于维护者发版,不用于日常 workspace 提取。
当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。
当你需要定义提取 schema、为文档标注数据、分析业务含义、生成业务指导文档时激活此 skill。在评估前必须先完成 schema 定义和数据标注。
当你需要编写或修改 program.py 提取代码、分析评估错误、调试提取逻辑、选择提取策略时激活此 skill。
当用户要求对某类文档或数据集开发提取程序时激活。提供从数据分析、schema 定义、标注、代码开发到评估迭代的完整无标注工作流。
| name | pdf-ai-explorer |
| description | 当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。 |
pdf-ai-explorer 负责长文档导航,不负责 schema、标注、评估或 agentic loop。
先检查:
pdf-ai-explorer --help
如果命令不可用,先安装:
uv tool install extract-agent
如果你只想单独安装这个导航工具,再单独装:
uv tool install pdf-ai-explorer
extract-agent 和 pdf-ai-explorer 发布到 PyPI,默认安装命令不需要指定私有 index。
按读取对象区分:
.pdf:需要 PDF 解析服务配置配置来源:
MEMECT_API_URL~/.config/pdf-ai-explorer/config.toml最小配置示例:
api_url = "http://localhost:6111/api"
或:
export MEMECT_API_URL="http://localhost:6111/api"
如果和 xdev 一起使用,建议把它和 XDEV_MEMECT_API_BASE 配成同一个地址。
最小验证:
pdf-ai-explorer --helppdf-ai-explorer outline /path/to/doc.jsonxdev doc 只显示前 1000 字,不够看agentic-extract run / autoxdev 的数据导入和评估outline 看整体结构search 找关键词read / content 看具体内容inspect 看节点上下文在 xdev doc <doc_id> 输出里通常会直接提示 docjson 路径。
也可以通过代码拿:
python -c "from xdev.api import get_docjson_path; print(get_docjson_path('doc_001'))"
pdf-ai-explorer outline <doc.json>:查看文档大纲pdf-ai-explorer read <doc.json> <page>:按页阅读pdf-ai-explorer search <doc.json> <query>:搜索关键词pdf-ai-explorer content <doc.json> <node_id>:查看指定节点内容pdf-ai-explorer inspect <doc.json> <node_id>:查看节点上下文outline,再 search 或 readsearch 适合快速定位字段相关章节inspect 适合理解节点在整棵文档树里的位置xdevagentic-extract