| name | glossary-rules |
| description | 处理术语时使用。 |
术语领域判据
技能加载
需要形成或判断译名时,加载并遵循 writing-guide 技能。
本技能负责 glossary 对象的收录资格、身份、边界、字段和安全覆盖。术语概念解释可直接使用本技能。
glossary 承载普通翻译无法稳定推出的专有译法、身份、指代、消歧和作品特有事实;维护资格由对象身份与翻译需求决定。运行时按 src 连续字面命中激活条目,把 src -> dst #info 交给翻译模型;info 向模型提供语义或条件指令,程序侧按固定 dst 是否出现检查应用。
1. 收录资格
先确定对象是否需要 glossary,再收束字段表达。
- 应收录:对象是专有实体、作品特有概念,或需要固定译法、身份、指代或消歧;普通翻译可能产生足以破坏一致性的分歧,且没有其它最终规则安全覆盖。
- 不应收录:普通称谓、职业、描述性或泛用内容,普通翻译能够稳定处理,且不承载必要身份或消歧,或已经由其它最终规则安全覆盖。
- 尚不能判断:补充调查后仍无法判断资格。继续按语境、边界或分支缩小问题;只有字段无法表达任何安全策略时,才列为需要补充信息。
人名、别名、姓氏、地名、家族、组织,以及作品特有的物品、技能、生物或概念,在身份可以合理建立时默认应收录。专有身份、译法稳定性和消歧需求共同决定资格。
固定译文、命中频率、共享词根和相似性只能作为辅助证据;术语资格仍由专有身份、作品特有性、身份、指代、消歧需求及翻译稳定性决定。
2. 领域发现方向
独立漏项检查使用三类证据基础:
- 名称与结构:完整非空
name_src、名称边界、特殊书写、并列、枚举、等级、对立体系和其它同构结构;
- 语境与关系:命名、定义、首次登场、别名、规则、获得、装备、发动、所属和身份变化等槽位;
- 译文与长尾:
dst / name_dst 的译法分歧、外文残留、身份线索、现有规则未覆盖的文件长尾与单次概念。
已确认对象在有限语境中的位置可抽象成槽位,再扫描同槽位的其它连续原文字面量;别名、同位说明、同系列形式、公共片段、相邻实体和文件结构生成候选,工程语境证据确定术语资格与语义身份。
包含术语发现目标时,三类证据基础各自形成至少一个独立方向。
全部候选都要使用 workspace.matchLiterals 在 src / name_src 上执行正式连续字面匹配,取得完整计数和有限代表证据。补充调查围绕具体缺失维度展开;频率、重复次数和已有错误用于排序与证据预算,资格由身份和翻译需求确定。
3. 表达路径与字段
按以下顺序收束:
- 取得身份、同名异义、指代、译法分布和边界所需的有限语境;
- 若合理取值不改变
src、dst 或翻译行为,直接形成规则;
- 若局部翻译输入可以判断适用条件,用
info 说明何时采用本条以及其它义项如何处理;
- 无法覆盖全部行为时,缩小连续字面边界,或拆分不同实体、别名和固定分支;
- 只有没有固定
dst、条件不可观察且不存在安全边界或分支时,才列为需要补充信息。
字段约束:
src 是 item.src 或 item.name_src 中的精确连续字面量,不使用正则;优先最短自然稳定边界;
dst 必须是非空固定译文;语义等价的风格差异按用户要求、工程风格、同类规则和目标语言惯例统一;
info 只写影响译法、指代或消歧的最少语义;按条件使用时写明操作性条件;
- 角色条目,应在
info 中填写性别信息:“男性角色”或“女性角色”,无法确定时填写“未知性别角色”,确有需要时可简洁追加年龄、职业、阵营、特殊身份等补充信息;
- 按输入语境使用的条目,其
info 必须让模型知道何时使用本条,以及不满足条件时按什么原则处理;可以使用“仅在……时采用本条,其他义项按上下文翻译”之类的操作性表达;
- 大小写策略依据敏感与不敏感完整匹配集合决定,真实大小写碰撞才使用
case_sensitive: true。
对象身份、适用边界和字段事实的证据优先级为:用户明确指定、工程内语境、已核验同类规则、目标语言一般表达;工程反例优先。多个身份正确的译名方案结合完整任务范围建立的作品风格和同类既有译名收束。
字段判例:
| 工程证据 | 正确处置 |
|---|
ミナ → 米娜,明确为女性角色 | 使用 info: "女性角色" |
ノヴァ → 诺瓦,明确是一座城市 | 使用 info: "地名" 进行消歧 |
アストラ → 阿斯特拉,明确是一把剑 | 使用 info: "物品,剑" |
エーテル → 以太,只需固定译名 | 使用 info: "" |
ルナ 同时是角色名和普通“月亮”,句内可以辨认 | 条件 info 说明角色时采用本条,其他义项按上下文翻译 |
May 是角色名而 may 是普通词 | 通过完整匹配使用 case_sensitive: true |
ALICE、Alice、alice 都指同一角色且无普通词误匹配 | 使用 case_sensitive: false 扩大覆盖 |
4. 词根候选与安全覆盖
对象资格与覆盖证明完成后,再使用词根优化规则集合。
语境确认多个形式确实属于同一业务对象或规则体系后,使用 workspace.deriveCommonLiteralRoots 枚举这些形式的公共连续字面片段。公共片段只作为词根候选,最终 src 由工程语境和完整匹配共同确定。
拟采用词根前,使用 workspace.matchLiterals 通过正式完整匹配比较:
- 分支 item 并集
B;
- 词根与分支并集
R;
- 新增命中
R - B。
每个新增命中都必须分别判定为已确认同一对象、可由清楚条件处理的义项,或新的待判断对象与边界反例;不能安全判定时保留其待确认状态。
5. 安全覆盖闭合
形成最终规则集合前,必须建立全部应收录术语对象与规则之间的覆盖关系:
- 每个应收录对象至少由一条最终规则覆盖;
- 词根合并前后保持全部已确认对象覆盖;
- 每条最终规则的新增命中都必须分类为同一对象、别名或派生形式、清楚条件可处理的义项,或已收窄 / 拆分排除;
- 每个无法判断的对象保持独立未决结论,并说明所缺事实和解除条件;
- 覆盖闭合后才允许删除冗余精确规则并进行集合最小化。
安全覆盖必须按对象和规则逐项核对,并能追溯每个对象的最终覆盖结论。
6. 最小充分集合
按以下顺序从全部应收录对象构造最终集合:收录资格、译名正确性、覆盖充分性、边界安全、作品风格、一致性、集合最小性。
由语义确实相关且已完成资格判断的成员组成词根候选子集;异义、失败或需要补充信息的成员分别保留为独立对象。合并失败时保留已确认安全的精确规则。
最终每个应收录对象都必须由直接、条件或精确分支规则覆盖;合并前后保持完整待判断对象集合、显式未决状态和全部已确认覆盖。
7. 判例
判例根据对应工程证据解释领域判据:
| 工程证据 | 结论 | 理由 |
|---|
ミナ 位于姓名栏,多处明确为女性角色,译名可确定为 米娜 | 应收录并直接形成规则 | 固定译名和性别提示不能由普通翻译稳定推出 |
knight 始终表示普通职业,没有作品专有译法或消歧信息 | 不应收录 | 普通翻译足以稳定处理 |
ルナ 可能指女性角色或普通“月亮”,句内可以辨认 | 保留角色条目并条件使用 | info 可说明角色条件,其他义项按上下文翻译 |
レイ 的可能身份要求互不兼容译名,孤立输入无法判断 | 需要补充信息 | 不存在固定值、可观察条件或更窄边界 |
セラ、セラ王女、セラ殿 都指同一角色,剩余称谓可正常翻译 | 可采用 セラ 词根 | 共同身份、译名和覆盖均已闭合 |
ドトール家、ドトール領、ドトール伯爵 都由同一家名派生,剩余文本可组合 | 可采用 ドトール 词根 | 词根稳定表达家名,分支身份由剩余文本表达 |
セラ 是角色,セラ教団 是与她无关的组织 | 不合并 | 字面重合不代表共同语义身份 |
黒騎士 与 白騎士 只共享普通词 騎士 | 不合并为 騎士 | 前缀承担必要区别 |
Alice 与 Alicia 只偶然共享 Ali | 不合并 | 公共字符不表达稳定共同概念 |
| 公共词根新增大量高频普通词 | 拒绝词根并保留精确规则 | 合并不能以不安全额外命中为代价 |