| name | commentator-distill |
| description | 蒸馏中文网络评论者的元方法学 skill. 基于山高县 v5→v15 14版踩坑提炼: 数据打捞(4路:粉丝收藏/GitHub备份/archive/freeweibo)+思想骨架挖掘(6维度+谱系评分)+修辞武器识别(高赞抽样+调用/禁用场景)+三层黑话分类(圈内黑话砍/招牌过度收尾限频/修辞武器留)+五步工作流(黑话过滤→思想骨架→武器选择→化用→自检)+反硬加守则. 输出: 完整可运行的 persona skill (SKILL+manifest+persona/{thought_map,voice,identity_card,rhetoric}.md). 适用: 任何中文评论者, 尤其封号/跨平台分散的. 何时触发: '蒸馏 XX'/'做一个 XX 的 skill'/'仿照山高县做 YY'/'commentator-distill' 等. |
Commentator Distill · 元蒸馏方法学
核心断言: 蒸馏一个中文网络评论者 = 三组分离 + 三层分类 + 反硬加.
山高县 v5→v15 14 版踩过所有能踩的坑. 这个 skill 把那些坑变成路标.
何时用
- 用户说 "蒸馏 XX" / "做一个 XX 的 skill" / "我想模仿 XX 的思维"
- 用户给出中文网络评论者(知乎/微博/B站/公众号活跃)
- 尤其适用: 账号被封 / 跨多平台 / 内容分散的作者
- 不适用: 严肃学术作者 (用学术摘录方法更好) / 短视频纯娱乐主播 / 个人技术博主
三组分离 (核心方法)
不要混在一起蒸馏. 必须分清三个组分:
| 组分 | 是什么 | 怎么提炼 | 输出文件 |
|---|
| 思想骨架 | 他用什么思想谱系想问题 (现实主义? 古典自由? 后现代?) | 6 维度调研 + 隐含框架评分 | persona/thought_map.md |
| 修辞武器 | 他用什么句式让别人记住 (古文收束? 三段排比? 数据轰炸?) | 高赞抽样 + 频次统计 + 调用场景 | persona/rhetoric.md |
| 圈内黑话 | 他用什么自创词给粉丝认 (这些是负资产) | 抽样 + 列禁用清单 | 不输出文件, 列入 voice 禁用清单 |
为什么必须分离: 山高县 v9-v13 把这三个混在一起蒸馏, 结果黑话堆 cosplay; v14 把三个一起砍, 输出像普通学者. v15 才把它们彻底分离, 才对.
六阶段工作流
阶段 1: 数据打捞 → method/01_data_recovery.md
阶段 2: 思想挖掘 → method/02_thought_excavation.md
阶段 3: 修辞识别 → method/03_rhetoric_voice.md
阶段 4: 黑话分类 → method/03_rhetoric_voice.md (同文件后半)
阶段 5: 生成 skill → method/04_skill_generation.md
阶段 6: 测试 + 迭代 → method/04_skill_generation.md (含 12 自检)
详见各 method 文件. 失败教训集中在 method/05_anti_patterns.md — 开工前必读.
输出物 (一套 persona skill)
<name>-v1/
├── SKILL.md 入口 + 工作流 + 三层分类
├── manifest.json 元数据 + 自检规则
└── persona/
├── thought_map.md 思想谱系地图 (谱系评分 + 反对清单 + 反框架)
├── identity_card.md 第一人称气质卡 (60-100 行)
├── voice.md 表达指南 (禁用清单 + 保留清单 + 句式模板 S1-Sn)
└── rhetoric.md 修辞武器库 (10±2 类 + 调用/禁用场景 + 反硬加守则)
每个文件的具体模板见 method/04_skill_generation.md.
三层黑话分类系统 (统一标准)
| 层 | 处置 | 判别 |
|---|
| 🔴 圈内黑话 | 砍 | 必须是粉丝才看得懂的自创代号; 用了就 cosplay |
| 🟡 招牌过度收尾 | 限频 (≤1/篇, 严格 ≤2/篇) | 他用得多但烂大街; 装饰感强 |
| ✅ 修辞武器 | 留 + 鼓励 | 任何汉语读者读得懂; 古典/排比/类比格式; 有结构性力量 |
判别公式: 给一个圈外读者看, 一脸懵 → 圈内黑话; 一看就懂但觉得"有劲" → 修辞武器.
⚠️ 反硬加守则 (v15 关键修正)
每个修辞武器都有专属语义场景. 不在场景里硬塞 = 装. 这是 v14→v15 最关键的发现.
- "仁义不施而攻守之势异也" → 攻守易位时才用; 长期僵局题硬加就是装.
- "X 都比 Y 有诚意" 排比 → 评一个被吹捧但实际烂的方案; 没有方案的宏观题硬加就是装.
- "时间戳冷峻陈述" → 当事人自打脸事件; 抽象题硬加就是装.
详见 method/03_rhetoric_voice.md 的"反硬加守则"章节.
默认偏向: 80% 的真原话其实没有招牌收尾, 自然收束在最后一句论证上. 招牌是少数高情绪场景的专属武器, 不是默认结尾.
工作流五步法 (蒸馏后 skill 的运行时)
题来 → 步骤 0 黑话过滤 → 步骤 1 思想骨架调用 → 步骤 2 修辞武器选择 → 步骤 3 化用真原话 → 步骤 4 自检 12 条
详见 method/04_skill_generation.md.
必读: 六大反模式 (v5→v15 真实失败)
| # | 反模式 | 解药 |
|---|
| 1 | 平台脚本污染 (知乎答平均 300+ 字, 套"首先/其次/总结") | 切风格源到微博/B站/动态短文 |
| 2 | 黑话堆砌 cosplay (v9-v13: 印敕书/吃敕书/嗑瓜子) | 三层分类: 圈内黑话砍, 武器留 |
| 3 | 砍过头洗成普通学者 (v14: 把古文收束当黑话一起砍) | 区分修辞武器和圈内黑话 |
| 4 | 油腻段子手 (心智模型抽象空转, 没有真原话支撑) | retrieve-first: 先检索同话题真原话, 再化用 |
| 5 | 普通人题攻击性外溢 (v10: 对失业者用"如果是个废物") | 红绿灯: 第三方/势力题红灯, 普通人题绿灯 |
| 6 | 招牌硬加 (v15 前期: 凡是结尾就来一句古文) | 反硬加守则: 每个招牌的专属语义场景 |
详见 method/05_anti_patterns.md.
适用边界
✅ 适用:
- 思想型评论者 (政治/历史/国际/经济)
- 风格鲜明 + 思想可识别的作者
- 跨平台分散的 / 已封号的 / 需要重建的
❌ 不适用:
- 纯学术作者 (用论文摘录就行)
- 短视频纯娱乐 (没有可蒸馏的思想骨架)
- 私人/隐私性内容多的作者 (会违背伦理)
文件
method/01_data_recovery.md — 四路打捞 + CDP 引擎 + 视频转写 + 清洗归一
method/02_thought_excavation.md — 6 维度调研 + 谱系评分 + 反对清单
method/03_rhetoric_voice.md — 修辞武器识别 + 三层黑话分类 + 反硬加守则
method/04_skill_generation.md — 文件骨架 + 五步工作流 + 自检 12 条 + 测试题集
method/05_anti_patterns.md — 六大反模式 + 解药 (开工前必读)
一句话气质
蒸馏不是模仿文风, 是建立思想骨架 + 修辞武器 + 黑话筛除的三引擎.
反硬加, 反 cosplay, 反洗白.