edith-distillator
EDITH 分支 Skill。无损文档蒸馏压缩,将 EDITH 索引的文档压缩为 Agent 可高效消费的精简版。是 EDITH "索引不倾倒"原则的工具化实现。支持语义拆分、EDITH 技能蒸馏模式和往返验证。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
EDITH 分支 Skill。无损文档蒸馏压缩,将 EDITH 索引的文档压缩为 Agent 可高效消费的精简版。是 EDITH "索引不倾倒"原则的工具化实现。支持语义拆分、EDITH 技能蒸馏模式和往返验证。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
EDITH 分支 Skill。为无文档的老项目(棕色地带项目)生成 AI 可消费的文档骨架。扫描代码提取业务模型、接口信息、数据架构、技术栈等。填补 EDITH INVENTORY 阶段中"老项目无文档可盘点"的缺口。支持全局扫描和模块深入两种模式。
EDITH 分支 Skill。需求路由前置分析,判断用户需求是否需要加载 EDITH 上下文以及加载哪一层。是三层加载策略(Layer 0/1/2)的决策入口,防止不必要的上下文加载。
استنادا إلى تصنيف SOC المهني
| name | edith-distillator |
| description | EDITH 分支 Skill。无损文档蒸馏压缩,将 EDITH 索引的文档压缩为 Agent 可高效消费的精简版。是 EDITH "索引不倾倒"原则的工具化实现。支持语义拆分、EDITH 技能蒸馏模式和往返验证。 |
EDITH 的分支 Skill,是 EDITH 工作原则 "索引不倾倒" 的工具化实现。将 document-project 扫描生成的大量文档压缩为 Agent 可高效消费的精简版,无损压缩而非摘要。
EDITH 文档生命周期:
代码考古(document-project)
↓ 生成全套项目文档(可能很大)
文档蒸馏(本 Skill) ← 你在这里
↓ 压缩为 Agent 可消费的精简版
↓ 按主题拆分,每个模块/服务一个分片
↓ 每个分片自包含,Agent 按需加载
技能生成(EDITH BOOTSTRAP SKILLS)
↓ 蒸馏版 → Repo Skill / Workflow Skill / Source Skill Stub
与 EDITH 理念的对应:
| EDITH 工作原则 | 本 Skill 的实现 |
|---|---|
| 索引不倾倒 | 无损压缩,只保留信号,去除冗余 |
| 模式优先于日志 | 提取决策、约束、关系,不是流水账 |
| 仓库真相留在仓库 | 蒸馏版指向源文件,不替代它 |
| 为交接而构建 | 蒸馏版自包含,新 Agent 可直接使用 |
典型压缩比 3:1 以上,大幅减少 token 消耗。
当用户说:
| 参数 | 必须 | 说明 |
|---|---|---|
| source_documents | 是 | 文件路径、目录路径或 glob 模式 |
| downstream_consumer | 否 | 下游用途(如 "PRD 创建"、"架构设计"),用于判断什么该留什么该去 |
| token_budget | 否 | 目标 token 数,超出则触发语义拆分 |
| output_path | 否 | 输出路径,默认在源文件旁生成 -distillate.md |
| --validate | 否 | 生成后做往返验证(代价高,仅关键文档使用) |
| --edith-mode | 否 | EDITH 技能蒸馏模式(见下方说明) |
| --quick-ref | 否 | 速查卡模式,生成 Layer 1 速查卡(~5% 源文,<2000 token) |
生成极速参考卡(Layer 1),目标压缩至源文的 ~5%。
--quick-ref 与 --edith-mode 正交:
--edith-mode 控制为谁蒸馏(下游消费者身份)--quick-ref 控制输出多细(输出粒度)--quick-ref --edith-mode=repo-skill = 为 Repo Skill 生成速查卡版本| 命令 | 输出 |
|---|---|
distillator source.md | 完整蒸馏版(~30%) |
distillator --quick-ref source.md | 通用速查卡(~5%) |
distillator --edith-mode=repo-skill source.md | Repo Skill 蒸馏版(~15%) |
distillator --quick-ref --edith-mode=repo-skill source.md | Repo Skill 速查卡(~5%,偏向接口和验证) |
速查卡使用固定结构(不按主题分组):
速查卡输出到 {name}-quick-ref.md,与蒸馏版同级目录。
压缩规则见 resources/quick-ref-rules.md。
当指定 --edith-mode 时,自动根据目标技能类型调整蒸馏策略:
| 模式值 | downstream_consumer 等效 | 保留重点 | 去除重点 |
|---|---|---|---|
repo-skill | edith-repo-skill | 接口契约、数据模型、构建命令、关键约束 | 环境搭建细节、迁移历史、所有 TODO |
workflow-skill | edith-workflow-skill | 业务流程、阶段定义、集成点、成功标准 | 代码实现细节、文件路径 |
source-skill | edith-source-skill | 访问路径、搜索策略、路由规则、Owner | 具体内容、配置细节 |
entry | edith-entry | 路由表、快速参考、模块索引 | 所有详细内容 |
EDITH 模式下的额外规则:
[未确认],不删除分析源文件:
从所有源文档中提取每一个离散信息:
按源内容自然分组,不用固定模板。常见分组:
应用压缩规则(见 resources/compression-rules.md):
---
type: edith-distillate
sources:
- "相对路径/到/源文件1.md"
- "相对路径/到/源文件2.md"
downstream_consumer: "用途说明"
created: "日期"
token_estimate: 估算token数
parts: 1
---
## 主题1
- 密集信息点1
- 密集信息点2; 关联信息点3
## 主题2
- 密集信息点4
{名称}-distillate/
├── _index.md # 导向、跨主题项、分片清单
├── 01-{主题slug}.md # 自包含的主题分片
├── 02-{主题slug}.md
└── 03-{主题slug}.md
_index.md 包含:
每个分片自包含:
---
type: edith-quick-ref
layer: 1
target_service: "服务名"
sources:
- "相对路径/到/源文件.md"
created: "日期"
token_budget: 2000
---
固定结构(不按主题分组):
输出到 {name}-quick-ref.md,严格 <2000 token。
可选,用于验证蒸馏版是否真的无损:
## 标题和 - 列表项当必须拆分时,按自然语义边界而非大小:
输入:docs/ 目录下的所有文档(架构、API、数据模型等,共 30K token)
输出:docs-distillate/(压缩到约 10K token,按主题拆分)
用途:Agent 开发新功能时只加载相关分片
输入:PRD + 用户研究笔记 + 竞品分析(共 20K token)
输出:product-distillate.md(压缩到约 6K token)
用途:架构设计时作为上下文输入
输入:5 份会议纪要(共 8K token)
输出:meetings-distillate.md(压缩到约 2.5K token)
用途:提取决策和行动项,丢弃过程讨论
输入:某微服务的蒸馏版(约 10K token)
输出:<service>-quick-ref.md(压缩到约 500-2000 token)
用途:日常开发时快速参考,不需要完整蒸馏版
命令:distillator --quick-ref distillates/<service>/
1. document-project 扫描老项目 → 全套文档
2. distillator --edith-mode=repo-skill → 蒸馏版(按主题拆分) ← Layer 2
3. distillator --quick-ref → 速查卡 ← Layer 1
4. 从速查卡提取路由信息 → 路由表 ← Layer 0
1. document-project 扫描老项目 → 生成全套文档(可能很大)
2. distillator 蒸馏压缩 → 生成 Agent 可高效消费的精简版
3. Agent 工作时 → 按需加载蒸馏版的对应分片