| name | report2article |
| description | 把已完成的研究报告编辑成更适合人类阅读的文章:在事实与证据不变的前提下,重构文章结构、章节划分、用词表达、整体风格和配图。适用于报告转文章、周报改长文和研究内容读者化;不用于补充研究或事实核查 |
Report to Article — 读者型编辑器
目标
把一份已完成的研究报告编辑成读者愿意读、容易懂、能够记住的文章。
这不是逐段搬运,也不是重新研究。成稿应做到:主线清楚、章节自然、语言顺畅、重点突出;需要视觉解释时有合适的图表或示意图。同时,原报告的事实与证据边界保持不变。
核心契约:语义保真,编辑自由
| 必须保持不变 | 可以编辑 | 严禁 |
|---|
| 对象、事实、数字、日期、名称、版本 | 文章顺序、章节划分、段落组合 | 新增报告外的事实、数据或观点 |
| 来源、归因、唯一链接 | 主标题、子标题、导语、过渡、结尾 | 删除任何独立且有意义的信息 |
| 因果、比较、时间关系 | 句式、用词、语态、详略节奏 | 把并列写成因果,把相关写成必然 |
| 结论及判断强弱,如“可能/已经/必然” | 等义改写、拆句合句、重复表达去重 | 改强或改弱原报告判断,伪造出处 |
| 报告明确表达的边界与不确定性 | 表格、引用、强调方式和配图 | 用标题、过渡或图像暗示报告没有的结论 |
保留的是独立信息,不是每次重复出现的原句。 同一事实在报告里重复三次,可以在文章里合并为一次完整表达;不同上下文、限定条件或来源不能被当作重复删除。
等义编辑的判定:读者从文章得到的事实、数字、归因、关系和结论强度,应与原报告一致。表达可以更自然,但不能为了“好读”牺牲准确性。
需要补充背景知识或外部信息时,不要直接写入正文。先标为编辑建议;只有用户明确授权补充研究后,才可检索、核验并与原报告内容区分。
开始前判断
- 受众与渠道已给出:按用户指定的专业程度、平台和篇幅编辑。
- 未给出受众:默认面向“对主题有兴趣但不掌握全部背景”的读者,采用专业、清楚、克制的风格,不因缺少画像而停工。
- 输入已经是文章:把任务视为结构、表达、风格和配图优化,不重复套用固定报告模板。
- 空报告或无法辨识主题:停止生成,说明缺少什么;不要凭空补内容。
工作流程
1. 建立信息基线
通读原报告,提取对象、事实、数据、判断、来源和链接,按 references/info-checklist-template.md 建立原子信息清单。记录判断强弱、归因和限定条件,后续所有编辑都要能回指这份基线。
2. 找到读者主线
用一句话回答:“读者读完应该理解什么?”答案只能来自报告已经明确表达的主题或结论。再按内容选择时间线、问题递进、对比、因果链或总分总中的一条主线,不堆叠多个模板。
结构和章节设计读取 references/logic-skeleton.md。核心原则:
- 开头尽快说明主题、变化或阅读价值,不从空泛背景起笔。
- 一个章节回答一个清晰的读者问题,章节顺序符合认知递进。
- 章节长短服从信息量,不机械均分,也不为每个对象强设一章。
- 结尾收束报告已有结论;原报告没有结论时,只回顾要点,不代替作者下判断。
3. 设计标题层级
主标题要客观、准确、清楚,遵守 references/title-rules.md。子标题是阅读路标:优先短语或短句,直接说明本节解决什么问题;同级标题句式一致,避免把对象全名、括号说明或整句摘要塞进标题。
中文子标题尽量不超过 16 字,复杂专名可合理放宽;清晰度优先于机械计数。英文标题尽量不超过 8 个说明性单词。
4. 做读者型改写
按 references/prose-style.md 改写正文:允许等义改写、合并重复表达、拆分过载长句、补充纯导航过渡、统一术语和调整段落节奏。
- 信息前置:先说发生了什么,再补条件和细节。
- 一段一个中心,首句帮助读者定位本段作用。
- 用具体主语和动词,减少报告腔、空话和连续名词堆叠。
- 专业术语首次出现时,用报告已有信息给出最短必要解释;报告没有解释时不自行发明。
- 过渡句只说明阅读方向,不新增因果、趋势、比较或价值判断。
5. 决定配图
只有视觉表达能明显降低认知负担时才配图,不按篇幅凑数量。需要配图或用户要求配图时,读取 references/visual-guidelines.md,在图表、时间线、流程图、架构图、对比表和概念示意图中选择最合适的形式。
- 优先复用原报告已有图表,其次用原报告数据重绘,再考虑概念示意图。
- 数据图只能使用报告中的数据;概念图必须标明“示意图”,不得制造事实感。
- 每幅图紧跟它解释的内容,并提供标题、图注、来源和替代文本。
- 只有用户明确要求产出实际图片且当前环境具备相应能力时,才生成图片文件;否则交付可直接执行的配图方案,不假装图片已经生成。
6. 长报告分块落盘
满足任一条件时,必须读取并执行 references/long-report-protocol.md:
- 对象数不少于 8 个;
- 正文约 6000 字或 8000 token 以上;
- 任一次读取出现截断。
长文先完成全局主线和章节大纲,再分块编辑、逐块落盘、按原子信息编号销账。分块只是防截断措施,不能让各节失去统一语气和前后呼应。
7. 双向复核
交付前完成两种检查:
- 正向覆盖:清单中的每条原子信息在文章中有准确落点。
- 反向溯源:文章中的事实、关系、判断和数据都能回到原报告;配图也遵守同一边界。
对象名、数字、日期和 URL 可用字面搜索辅助;判断强弱、因果关系、去重是否误删等语义项必须逐段对读,不能用搜索结果代替人工判断。长报告还要从原报告重新二次派生完整原子信息清单,与首次清单逐条比对。
输出
- 短报告:默认行内返回完整文章。
- 长报告:写入
<报告名>-article.md;无报告名时使用 report-article.md,避免单次输出截断。
- 配图:实际生成时放在文章同级的
<文章名>-assets/ 目录并嵌入正文;未生成时,在正文相应位置给出结构化配图方案。
- 校验说明:交付时报告
O 个对象 / F 条事实 / D 个数据点 / J 条判断 / L 个唯一链接,全部可追溯。原报告没有某类信息时如实写 0,不补造。
发布闸门
以下任一情况出现,成稿不能交付:遗漏独立信息;数字或日期变化;来源错配;判断强弱漂移;新增未经授权的事实或推论;标题、过渡或图片暗示原报告没有的结论;实际图片缺少来源、图注或替代文本。