with one click
pdf-ai-explorer
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页/按节点浏览 PDF 文档结构时激活此 skill。
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Menu
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页/按节点浏览 PDF 文档结构时激活此 skill。
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Based on SOC occupation classification
当用户要启动 agentic loop、使用 one-click auto、通过 Python API 调用完整流程、或在运行过程中接收 callback 和 heartbeat 事件时使用此 skill。如果用户当前主要是在准备或维护 `.xdev` 数据,先转到 xdev skill。
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
当用户要求更新 extract-agent 版本号、补 changelog、构建 dist、推送代码、或发布到 PyPI 时使用此 skill。只用于维护者发版,不用于日常 workspace 提取。
当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。
当你需要定义提取 schema、为文档标注数据、分析业务含义、生成业务指导文档时激活此 skill。在评估前必须先完成 schema 定义和数据标注。
当你需要编写或修改 program.py 提取代码、分析评估错误、调试提取逻辑、选择提取策略时激活此 skill。
| name | pdf_ai_explorer |
| description | 当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页/按节点浏览 PDF 文档结构时激活此 skill。 |
当文档过长时,xdev doc 只返回前 1000 字并提示 docjson 路径。使用 pdf-ai-explorer 按需导航完整内容。
pdf-ai-explorer 在读取 .pdf 文件时会调用 PDF 解析服务(读取 .json 文件时不需要)。
推荐配置文件:
# ~/.config/pdf-ai-explorer/config.toml
api_url = "http://localhost:6111/api"
也可以用环境变量覆盖:
export MEMECT_API_URL="http://localhost:6111/api"
配置优先级:
api_url)MEMECT_API_URL~/.config/pdf-ai-explorer/config.tomlhttp://localhost:6111/api与 xdev 配合时,建议把该地址和 XDEV_MEMECT_API_BASE 保持一致。
# 在 xdev doc 输出中会提示 docjson 路径,例如:
# [文档过长,仅显示前 1000 字。完整文档路径: .xdev/data/docjson/doc_001.json]
# 也可以通过代码获取
python -c "from xdev.api import get_docjson_path; print(get_docjson_path('doc_001'))"
| 命令 | 用途 | 示例 |
|---|---|---|
pdf-ai-explorer outline <doc.json> | 查看文档大纲结构 | --depth 3 展开更多层级 |
pdf-ai-explorer read <doc.json> <page> | 按页阅读内容 | read doc.json 5-8 |
pdf-ai-explorer search <doc.json> <query> | 搜索关键词 | search doc.json "营业收入" |
pdf-ai-explorer content <doc.json> <ID> | 查看指定节点内容 | 节点 ID 从 outline/search 获取 |
pdf-ai-explorer inspect <doc.json> <ID> | 查看节点上下文 | 路径、兄弟节点、子节点 |
1. outline 了解文档结构
$ pdf-ai-explorer outline .xdev/data/docjson/doc_001.json
2. search 定位关键词
$ pdf-ai-explorer search .xdev/data/docjson/doc_001.json "营业收入"
3. read/content 查看具体内容
$ pdf-ai-explorer read .xdev/data/docjson/doc_001.json 5-8
$ pdf-ai-explorer content .xdev/data/docjson/doc_001.json <node_id>
4. inspect 查看节点上下文(路径、兄弟、子节点)
$ pdf-ai-explorer inspect .xdev/data/docjson/doc_001.json <node_id>
outline 了解结构,再定向查看,避免盲目翻页search 支持中文关键词,用于快速定位目标信息content 命令的节点 ID 来自 outline 或 search 的输出inspect 可以查看节点在文档树中的路径和相邻节点,帮助理解文档层级