| name | style-extractor |
| description | 从一批写作范本中提取一份可操作、可检查的「风格宪法」(style constitution)。输入任意文体的样本(书、文章、文档、脚本…),输出一组分维度、每条都能被 critic 判定的写作规则,用于指导后续生成并支持逐轮迭代优化。用户说"提取写作风格 / 分析这些范文的风格 / 建一份风格指南 / 让生成对齐某种文风"时使用。它产出的是**方法的一次运行结果**,不绑定任何题材或领域。 |
写作风格提取器(style-extractor)
把"这些文字读起来是这个味道"变成一份可执行的规则清单:每条规则要么"做 X"、要么"不做 Y",能被人或 critic 逐条判定。它不做风格识别 / 作者归因(那是 stylometry 的活),它做面向生成的风格描述。
这是一个通用能力:题材、语言、领域都不写死在本 Skill 里。数学书、历史长文、公众号文章跑同一套方法,只是输入的范本不同、产出的宪法不同。产出物属于调用方的领域(应落在该 domain 的 examples/ 或 truth 真源),不留在本 Skill 内。
何时用 / 何时不用
- 用:有一批体现目标风格的范本,想把风格固化成规则去指导生成;或想迭代改进已有风格指南。
- 不用:只想判断"两段文字像不像 / 谁写的"——那是统计文体学(Burrows' Delta / stylometry),不是本 Skill。
输入
- 范本集:3 段以上体现目标风格的文本。越覆盖不同"语域"越好——同一作者的说理段、叙事段、带旁白/脚注的段、开场段各取一点,别只取一种。
- 可选·反例:明确"不要这种味道"的负样本,用于让规则更锐利。
- 可选·已有宪法:迭代场景下,把上一版宪法 + 新的人工修改一起喂进来,做增量修订而非从零重写。
采样原则:跨语域采样。只喂一种段落,提出来的规则会偏。至少覆盖:开场 / 说理 / 举例 / 旁白或脚注 / 结尾。
方法(提取流程)
- 通读并跨语域采样:从范本里挑出覆盖不同语域的代表段落,标注每段属于哪种语域。
- 逐维度归纳:对下面「维度框架」每一维,问"这些范本在这一维上的一致做法是什么?",写成祈使句规则。
- 锐化为可判定:把每条规则改写成能判定通过/违反的形式。
- 坏:"语言要生动有趣。"(无法判定)
- 好:"每个核心概念至少配一个取自日常经验的类比。"(可数、可查)
- 配证据:每条规则尽量附一句范本里的原文例证(正例;有反例更好),让规则可追溯、可复核。
- 标风险维度:哪些维度是"硬约束"(违反必改)、哪些是"软偏好"(尽量遵守),分开标注。
- 输出初版宪法 + few-shot 金标段落:除了规则清单,再从范本里选 3–5 段"完美范例"一并交付——范例本身就是最强的风格信号,供生成时直接当 few-shot。
- 一次互博校准(probe → critic → revise):用初版宪法做一个小型真实生成任务,再用同一宪法逐条 critic,最后把 critic 暴露出的缺口修回宪法,形成最终候选版。
- probe 任务必须贴近调用方真实用途,但规模要小(约 200–500 字、1 个小节、1 个短场景)。
- critic 必须逐条判定 pass/fail/partial,并指出违反哪条规则,而不是泛泛评价。
- revise 的对象主要是宪法:补规则、改硬/软约束、补失败信号、补 few-shot 说明。probe 文本的修订版可作为测试记录,但不自动写入正式产物。
- 互博只跑一轮,避免在没有人工 gate 的情况下自我强化偏差。
- 留迭代槽:宪法末尾留一个"待沉淀"区,供后续 critic 反复挑出的同类问题登记,稳定后升级为正式规则。
维度框架(通用起点,按题材增删)
下面是任何写作风格都值得检查的默认维度。不是每个题材都全用,也允许新增本题材特有的维度(如技术写作的"符号引入节奏"、剧本的"场景切换")。
- 句子与节奏 — 句长分布、长短交替、从句密度、单句成段 / 破折号插入等节奏手段。
- 段落结构 — 一段承载多少想法、典型段长、段内展开方式。
- 开场方式 — 每个单元(章 / 节 / 段)如何起头:现象先行 / 定义先行 / 提问 / 引语 / 历史。
- 与读者的关系(温度) — 人称、距离感、是否承认困难与无知、幽默、是否下明确价值判断。
- 叙事弧 / 组织语法 — 单元内部的推进套路(如"直觉→例子→一般化→余味")、单元之间如何承接。
- 具体化手段 — 类比 / 比喻 / 举例的密度与取材(日常经验 vs 抽象)、例子先于还是后于抽象。
- 专业内容的呈现 — 术语首次出现如何交代、符号 / 公式 / 代码 / 数据的引入节奏与"裸奔"禁忌。
- 旁支信息的安置 — 脚注 / 边注 / 附录承担什么(出处 / 趣闻 / 技术补充),如何保持正文轻快。
- 术语与命名一致性 — 同一概念是否固定叫法、外来词 / 人名的处理约定。
- 收尾方式 — 单元如何结束:机械总结 / 余味判断 / 悬念 / 引语。
输出格式
一组 Markdown 产物,建议结构:
# <风格名> Style Guide / Constitution
- 来源:<范本清单>
- 用途:<谁用、怎么用>
- 状态:final-candidate after one probe/critic calibration
- 原则:每条规则可检查("做 X" / "不做 Y")。
## 一、<维度名>
- <规则>(硬约束 / 软偏好)。例证:"<范本原文片段>"
...
## 金标段落(few-shot)
1. <直接可当范例的段落节选 + 一句"它示范了哪几条规则">
...
## 互博校准摘要
- Probe task:
- Probe result summary:
- Critic findings:
- Revisions applied to this guide:
## 待沉淀(迭代回环填充)
-
另存一份可选测试记录(不作为正式风格真源):
# Style Probe / Critic Record
## Probe task
## Generated probe text
## Rule-by-rule critic
## Revised probe text
## Constitution changes proposed/applied
与迭代优化的衔接
本 Skill 负责"提取出经过一次互博校准的候选宪法"。持续变好靠调用方的回环:
- 提取时先跑一轮初版宪法 → probe 生成 → Style Critic → 宪法修订,得到 final-candidate。
- 生产时用宪法 + 金标段落双管齐下(规则约束 + few-shot 隐式对齐)。
- 生产后继续跑 Style Critic(按宪法逐条 pass/fail + 指出违反点)。
- 反复出现的违反 / 人工修改,登记进"待沉淀",稳定后升级为正式规则,并补一个回归样例。
- 需要自动优化 prompt 时,可把"宪法 + 好/坏样本对"接入 DSPy 之类的框架——但那要求先有评测数据,别过早上。
判据:换一个题材,本 Skill 一行不改;变的只是喂进来的范本和跑出来的宪法。