بنقرة واحدة
pdf-ai-explorer
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
当用户要启动 agentic loop、使用 one-click auto、通过 Python API 调用完整流程、或在运行过程中接收 callback 和 heartbeat 事件时使用此 skill。如果用户当前主要是在准备或维护 `.xdev` 数据,先转到 xdev skill。
当用户要求更新 extract-agent 版本号、补 changelog、构建 dist、推送代码、或发布到 PyPI 时使用此 skill。只用于维护者发版,不用于日常 workspace 提取。
当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。
当你需要定义提取 schema、为文档标注数据、分析业务含义、生成业务指导文档时激活此 skill。在评估前必须先完成 schema 定义和数据标注。
当你需要编写或修改 program.py 提取代码、分析评估错误、调试提取逻辑、选择提取策略时激活此 skill。
当用户要求对某类文档或数据集开发提取程序时激活。提供从数据分析、schema 定义、标注、代码开发到评估迭代的完整无标注工作流。
| name | pdf-ai-explorer |
| description | 当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。 |
pdf-ai-explorer 负责长文档导航,不负责 schema、标注、评估或 agentic loop。
先检查:
pdf-ai-explorer --help
如果命令不可用,先安装:
uv tool install extract-agent
如果你只想单独安装这个导航工具,再单独装:
uv tool install pdf-ai-explorer
extract-agent 和 pdf-ai-explorer 发布到 PyPI,默认安装命令不需要指定私有 index。
按读取对象区分:
.pdf:需要 PDF 解析服务配置配置来源:
MEMECT_API_URL~/.config/pdf-ai-explorer/config.toml最小配置示例:
api_url = "http://localhost:6111/api"
或:
export MEMECT_API_URL="http://localhost:6111/api"
如果和 xdev 一起使用,建议把它和 XDEV_MEMECT_API_BASE 配成同一个地址。
最小验证:
pdf-ai-explorer --helppdf-ai-explorer outline /path/to/doc.jsonxdev doc 只显示前 1000 字,不够看agentic-extract run / autoxdev 的数据导入和评估outline 看整体结构search 找关键词read / content 看具体内容inspect 看节点上下文在 xdev doc <doc_id> 输出里通常会直接提示 docjson 路径。
也可以通过代码拿:
python -c "from xdev.api import get_docjson_path; print(get_docjson_path('doc_001'))"
pdf-ai-explorer outline <doc.json>:查看文档大纲pdf-ai-explorer read <doc.json> <page>:按页阅读pdf-ai-explorer search <doc.json> <query>:搜索关键词pdf-ai-explorer content <doc.json> <node_id>:查看指定节点内容pdf-ai-explorer inspect <doc.json> <node_id>:查看节点上下文outline,再 search 或 readsearch 适合快速定位字段相关章节inspect 适合理解节点在整棵文档树里的位置xdevagentic-extract