一键导入
xdev
当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
当用户要启动 agentic loop、使用 one-click auto、通过 Python API 调用完整流程、或在运行过程中接收 callback 和 heartbeat 事件时使用此 skill。如果用户当前主要是在准备或维护 `.xdev` 数据,先转到 xdev skill。
当文档内容过长无法一次查看、需要搜索关键词定位信息、或需要按页按节点浏览 DocJSON/PDF 结构时使用此 skill。适合与 xdev、agentic-extract 配合做长文档阅读与定位。
当用户要求更新 extract-agent 版本号、补 changelog、构建 dist、推送代码、或发布到 PyPI 时使用此 skill。只用于维护者发版,不用于日常 workspace 提取。
当你需要定义提取 schema、为文档标注数据、分析业务含义、生成业务指导文档时激活此 skill。在评估前必须先完成 schema 定义和数据标注。
当你需要编写或修改 program.py 提取代码、分析评估错误、调试提取逻辑、选择提取策略时激活此 skill。
当用户要求对某类文档或数据集开发提取程序时激活。提供从数据分析、schema 定义、标注、代码开发到评估迭代的完整无标注工作流。
| name | xdev |
| description | 当用户需要准备或维护 workspace 数据、导入或同步 PDF、查看文档、定义 schema、管理标注、调试 program.py、或运行评估时使用此 skill。如果用户只是想启动 agentic loop 或通过 Python API 一键运行完整流程,转到 agentic-extract skill。 |
xdev 负责 workspace 的数据层。
开始前先确认当前环境至少能满足本次任务。
至少检查:
xdev --help
如果任务里会阅读超长文档,再额外检查:
pdf-ai-explorer --help
如果 xdev 不可用,先安装:
uv tool install extract-agent
extract-agent 发布到 PyPI,默认安装命令不需要指定私有 index。
xdev 配置来源:
~/.config/xdev/config.json$CWD/.xdev/config.jsonXDEV_*按任务区分最小配置:
.xdev 数据:通常只要命令可用xdev import-data --set-id:需要 base_url,可放配置里或命令行传 --base-urlxdev import-data --pdfs / xdev sync-pdfs:需要本机 ppx 命令;pdf_parse_concurrent 控制批量 PDF 解析并发program.py 使用 code tools:需要在 .xdev/config.json 里显式配置 code_extractor,xdev 会把 tool_hub 注入到 extract(document, tool_hub)常用环境变量:
XDEV_BASE_URLXDEV_PDF_PARSE_CONCURRENTXDEV_MEMECT_API_BASEXDEV_DATA_DIR最小验证:
xdev listpdf-ai-explorer --help优先在这些场景使用本 skill:
.xdev/program.py不要把下面这些事放在本 skill 里:
agentic-extract run / agentic-extract auto 的迭代逻辑program.py 或做评估,读 references/run_and_eval.md.xdev 已经准备好,用户要启动 agentic 迭代,切到 agentic-extract skillworkspace 是长期目录,不是一次性运行目录.xdev/ 是数据层,program.py 是提取实现,.agent_state/ 是运行态xdev 管数据,再用 agentic-extract run 做迭代agentic-extract auto 只是 one-click 入口,不替代日常的数据维护xdev doc 的截断输出;应切到 pdf-ai-explorerxdev init /path/to/workspacecd /path/to/workspacexdev import-data 或 xdev sync-pdfs 准备 .xdevxdev list / xdev doc / xdev label-guide / xdev label-status 理解数据和标注状态program.pyxdev run <doc_id> 做单文档调试xdev eval 做评估agentic-extract skill