一键导入
doc-skill-generator
从文档(网页、PDF、本地文件)中提取内容,自动生成 Cursor Skill。 使用 Playwright BFS 深度采集网页(含 SPA/Vue/React),支持 Tab 展开、折叠区域、懒加载、多页面遍历。 两阶段流程:先提取到临时文件 → 确认后生成 Skill。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
从文档(网页、PDF、本地文件)中提取内容,自动生成 Cursor Skill。 使用 Playwright BFS 深度采集网页(含 SPA/Vue/React),支持 Tab 展开、折叠区域、懒加载、多页面遍历。 两阶段流程:先提取到临时文件 → 确认后生成 Skill。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
跨 IDE / 跨 LLM 的声明式工作流引擎,以 CLI 状态机形态运行。把多步任务、用户阻塞、条件循环、跨 LLM CLI 协作(claude / codex / caller)描述为一份 YAML,CLI 负责落盘、推进、崩溃恢复,所有推理交给 caller(你)或外部 LLM。当用户提到"workflow"、"流程"、"多步任务"、"跨 LLM 协作"、"用户确认环节"、"自动化 SOP"、"批量处理"、"恢复昨天的任务",或意图需要 ≥3 个节点、需要审计、需要可重复 SOP 时使用。Python 3.10+,零运行时网络依赖。
skillix-hub 项目标准化 Skill 开发流程指南和脚手架工具。当用户要求创建新 Skill、 初始化 Skill 目录结构、或询问 Skill 开发规范时使用。提供 10 阶段完整生命周期: 需求命名、可行性分析、设计文档、讨论迭代、代码开发、单元测试、测试报告、技术文档、README 同步、docs 同步。
将知识材料编译为结构化 Wiki。AI 即编译器,Markdown-in Markdown-out,覆盖度追踪,增量编译。
本地知识资料索引与 Wiki 编译
第一性原理分析。将问题拆解到不可置疑的基础事实,系统挑战每一个假设,再从地基向上重建解决方案——而非依赖惯例或类比。适用于成本质疑、架构选型、根因分析、产品定义、约束破除、战略决策。
苏格拉底式批判性思维分析。自动识别需求分析、系统设计、技术选型、数据分析四类场景,智能决定快速结论(≤1问)或深度探索(≤5问),防止过度追问与草率结论。Socratic critical thinking for requirements, design review, tech research, and data analysis.
| name | doc-skill-generator |
| description | 从文档(网页、PDF、本地文件)中提取内容,自动生成 Cursor Skill。 使用 Playwright BFS 深度采集网页(含 SPA/Vue/React),支持 Tab 展开、折叠区域、懒加载、多页面遍历。 两阶段流程:先提取到临时文件 → 确认后生成 Skill。 |
从文档中提取内容,自动生成可用的 Cursor Skill。支持网页(含 SPA)、PDF、本地 Markdown/文本文件。
# 安装依赖
cd skills/doc-skill-generator && npm install
# 全局安装
node skills/doc-skill-generator/tool.js install '{"target":"~/.cursor/skills/doc-skill-generator"}'
# 更新
node skills/doc-skill-generator/tool.js update-self '{"target":"~/.cursor/skills/doc-skill-generator"}'
| 依赖 | 说明 |
|---|---|
| Playwright Skill | 网页深度采集引擎(BFS 遍历、Tab 展开、SPA 渲染) |
| pdf-parse | PDF 文件解析(npm 依赖,install 时自动安装) |
1. fetch → 采集文档,保存到临时文件
2. show → 检查提取内容是否完整
3. analyze → 分析文档类型,输出 Skill 规格建议
4. generate → 生成到暂存目录(data/generated/)
5. install-skill → 从暂存目录安装到目标路径
node skills/doc-skill-generator/tool.js <command> '<JSON参数>'
# 从网页采集(Playwright BFS 深度采集)
node tool.js fetch '{"sources":[{"type":"url","value":"https://docs.example.com"}]}'
# 从 PDF 采集
node tool.js fetch '{"sources":[{"type":"pdf","value":"./manual.pdf"}]}'
# 多文档源
node tool.js fetch '{"sources":[{"type":"url","value":"https://docs.example.com"},{"type":"pdf","value":"./guide.pdf"}]}'
# 单页面模式(不遍历子页面)
node tool.js fetch '{"sources":[{"type":"url","value":"https://example.com/api"}],"singlePage":true}'
# 控制采集深度和页面数
node tool.js fetch '{"sources":[{"type":"url","value":"https://docs.example.com"}],"maxDepth":2,"maxPages":20}'
# 列出所有提取结果
node tool.js list-extracts '{}'
# 查看提取详情
node tool.js show-extract '{"id":"ext-xxx"}'
# 导出为 Markdown
node tool.js show-extract '{"id":"ext-xxx","format":"markdown"}'
# 追加采集(补充遗漏页面)
node tool.js append '{"id":"ext-xxx","sources":[{"type":"url","value":"https://docs.example.com/advanced"}]}'
# 删除提取结果
node tool.js delete-extract '{"id":"ext-xxx"}'
# 分析文档类型,输出 Skill 规格建议
node tool.js analyze '{"id":"ext-xxx"}'
# 预览将生成的 Skill 结构(不写文件)
node tool.js preview '{"id":"ext-xxx","skillName":"my-api-client"}'
# 生成 Skill(输出到暂存目录 data/generated/my-api-client/)
node tool.js generate '{"id":"ext-xxx","skillName":"my-api-client"}'
# 从暂存目录安装到目标路径
node tool.js install-skill '{"skillName":"my-api-client","target":"~/.cursor/skills/my-api-client"}'
# 更新已生成的 Skill(重新读取文档源 → 生成 → 安装)
node tool.js update '{"target":"~/.cursor/skills/my-api-client"}'
| 场景 | 操作 |
|---|---|
| 用户给出文档 URL 或 PDF | 执行 fetch 采集 |
| 采集完成后 | 执行 show-extract 展示摘要,询问是否完整 |
| 用户确认内容完整 | 执行 analyze + generate |
generate 完成后 | 读取 skillMdPrompt,在暂存目录创建 SKILL.md |
| SKILL.md 创建完成 | 执行 install-skill 安装到目标路径 |
| 用户说"遗漏了某个页面" | 执行 append 追加采集 |
| 用户说"生成 Skill" | 执行 generate |
| 用户说"更新 Skill" | 执行 update(重新读取文档源) |
generate 命令将结果输出到暂存目录(data/generated/{skillName}/),不会 直接写到目标路径。
返回结果中的 skillMdPrompt 字段包含 SKILL.md 创建指引,Agent 需要:
skillMdPrompt 中提到的关键文档文件(在暂存目录的 docs/ 下)install-skill 将暂存目录安装到最终目标路径数据存在 Skill 安装目录的同级 doc-skill-generator-data/ 下:
~/.cursor/skills/
├── doc-skill-generator/ # Skill 代码
└── doc-skill-generator-data/ # 数据目录
├── extracts/ # 提取结果(临时文件)
├── cache/ # 文档缓存
├── specs/ # Skill 规格
└── generated/ # 生成暂存(generate 输出)
用户: 帮我读一下 https://docs.stripe.com/api 生成一个 Skill
Agent:
1. fetch → Playwright BFS 采集(snapshot → LLM 分析导航 → 遍历子页面)
2. show-extract → 展示摘要:"共 45 页,128 个代码块"
3. 用户确认 → analyze + generate(输出到暂存目录)
4. 根据 skillMdPrompt 创建 SKILL.md
5. install-skill → 安装到 ~/.cursor/skills/stripe-api/
用户: 这个 PDF 是设备控制手册,帮我生成 Skill
[附件: device-manual.pdf]
Agent:
1. fetch → PDF 解析,提取 120 页内容
2. show-extract → 展示摘要
3. analyze → 识别为 CLI Reference
4. generate → 生成到暂存目录
5. install-skill → 安装 device-controller Skill
用户: 好像少了高级配置那部分
Agent:
1. append → 追加采集 https://docs.example.com/advanced
2. show-extract → 更新后的摘要
3. 用户确认 → generate + install-skill