con un clic
pdf-ai-explorer
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页/按节点浏览 PDF 文档结构时激活此 skill。
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Menú
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页/按节点浏览 PDF 文档结构时激活此 skill。
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Basado en la clasificación ocupacional SOC
当用户要启动 agentic loop、使用 one-click auto、通过 Python API 调用完整流程、或在运行过程中接收 callback 和 heartbeat 事件时使用此 skill。如果用户当前主要是在准备或维护 `.xdev` 数据,先转到 xdev skill。
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
当用户要求更新 extract-agent 版本号、补 changelog、构建 dist、推送代码、或发布到 PyPI 时使用此 skill。只用于维护者发版,不用于日常 workspace 提取。
当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。
当你需要定义提取 schema、为文档标注数据、分析业务含义、生成业务指导文档时激活此 skill。在评估前必须先完成 schema 定义和数据标注。
当你需要编写或修改 program.py 提取代码、分析评估错误、调试提取逻辑、选择提取策略时激活此 skill。
| name | pdf_ai_explorer |
| description | 当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页/按节点浏览 PDF 文档结构时激活此 skill。 |
当文档过长时,xdev doc 只返回前 1000 字并提示 docjson 路径。使用 pdf-ai-explorer 按需导航完整内容。
pdf-ai-explorer 在读取 .pdf 文件时会调用 PDF 解析服务(读取 .json 文件时不需要)。
推荐配置文件:
# ~/.config/pdf-ai-explorer/config.toml
api_url = "http://localhost:6111/api"
也可以用环境变量覆盖:
export MEMECT_API_URL="http://localhost:6111/api"
配置优先级:
api_url)MEMECT_API_URL~/.config/pdf-ai-explorer/config.tomlhttp://localhost:6111/api与 xdev 配合时,建议把该地址和 XDEV_MEMECT_API_BASE 保持一致。
# 在 xdev doc 输出中会提示 docjson 路径,例如:
# [文档过长,仅显示前 1000 字。完整文档路径: .xdev/data/docjson/doc_001.json]
# 也可以通过代码获取
python -c "from xdev.api import get_docjson_path; print(get_docjson_path('doc_001'))"
| 命令 | 用途 | 示例 |
|---|---|---|
pdf-ai-explorer outline <doc.json> | 查看文档大纲结构 | --depth 3 展开更多层级 |
pdf-ai-explorer read <doc.json> <page> | 按页阅读内容 | read doc.json 5-8 |
pdf-ai-explorer search <doc.json> <query> | 搜索关键词 | search doc.json "营业收入" |
pdf-ai-explorer content <doc.json> <ID> | 查看指定节点内容 | 节点 ID 从 outline/search 获取 |
pdf-ai-explorer inspect <doc.json> <ID> | 查看节点上下文 | 路径、兄弟节点、子节点 |
1. outline 了解文档结构
$ pdf-ai-explorer outline .xdev/data/docjson/doc_001.json
2. search 定位关键词
$ pdf-ai-explorer search .xdev/data/docjson/doc_001.json "营业收入"
3. read/content 查看具体内容
$ pdf-ai-explorer read .xdev/data/docjson/doc_001.json 5-8
$ pdf-ai-explorer content .xdev/data/docjson/doc_001.json <node_id>
4. inspect 查看节点上下文(路径、兄弟、子节点)
$ pdf-ai-explorer inspect .xdev/data/docjson/doc_001.json <node_id>
outline 了解结构,再定向查看,避免盲目翻页search 支持中文关键词,用于快速定位目标信息content 命令的节点 ID 来自 outline 或 search 的输出inspect 可以查看节点在文档树中的路径和相邻节点,帮助理解文档层级