| name | wow-translation |
| description | 魔兽世界英文翻译技能,用于翻译英文攻略、字幕等内容为中文。触发场景: (1) 翻译 .srt 字幕文件 (2) 翻译魔兽世界相关的英文文本 (3) 用户提及魔兽/WoW翻译需求 术语参照:技能、天赋、黑话对照表。
|
魔兽世界英文翻译
翻译原则
翻译必须符合以下标准:
- 中文语法规范 — 符合中文表达习惯,不生搬硬套英文句式
- 中文语境 — 考虑游戏玩家的阅读习惯和表达方式
- 术语准确性 — 涉及技能、天赋、术语时,必须参照对照文件
术语对照文件
翻译涉及魔兽术语时,必须先查找以下文件:
| 文件 | 用途 | 结构 |
|---|
abilities_translation.json | 技能中英文对照 | spell(ID), name_cn, name_en |
trees_translation.json | 天赋树中英文对照 | id, name_cn, name_en |
pvp_translation.json | PVP天赋对照 | id, name_cn, name_en |
wow_slang.json | 黑话术语对照 | 分类结构:abbr, full, meaning |
查找方法:
- 技能名:grep
name_en 字段匹配英文,取 name_cn
- 黑话:grep
abbr 字段匹配缩写,保留原文并加括号解释
黑话/术语处理规则
遇到黑话或缩写时,保留原文,加括号解释:
英文:"You're NPC."
中文:"你是一个NPC(非玩家角色)。"
英文:"We need more DPS."
中文:"我们需要更多DPS(每秒伤害输出)。"
不要直接将黑话翻译成中文,而是保留英文缩写并添加解释。
翻译样本参考
参照 assets/samples/ 中的 en/cn 对照文件理解翻译风格:
en0.srt / cn0.srt — 元素萨满指南
en2.srt / cn2.srt — 邪邪DK PvP指南
关键观察点:
- 构建名称(Plague Doctor → 瘟疫医生)直接翻译
- 技能名称(Clawing Shadows → 暗影之爪)参照术语表翻译
- 黑话缩写(DPS, NPC)保留并加括号
SRT 字幕翻译
格式要求
SRT 文件翻译必须严格保持原有格式和时间线:
序号
时间线 --> 时间线
翻译文本
空行分隔
不可改变:
- 时间线格式
00:00:00,000 --> 00:00:05,000
- 时间间隔和显示时长
- 序号
时间线断句处理
由于语音识别生成的字幕断句可能不自然,翻译时需:
- 查看上下文 — 前后字幕条目结合起来理解完整意思
- 保持连贯性 — 断句处尽量让中文表达完整,不强行拆分语义
- 标注断句问题 — 如果原断句严重影响理解,在人工审核版本中标注
特殊内容处理
| 内容 | 处理方式 |
|---|
[Music] | [音乐] |
[Applause] | [掌声] |
时间线引用 [00:00 --> 00:05] | 保持不变 |
| 拼写错误/口误 | 人工审核版本标注 |
输出版本
翻译完成后提供两种版本供用户选择:
1. AI 模糊版本
- 直接翻译,不标注不确定部分
- 可能有术语偏差或断句问题
- 适合快速参考
2. 人工审核版本
- 不确定部分用
【需审核】 标注
- 标注类型:
【需审核:术语歧义】 — 英文可能有多种中文对应
【需审核:断句问题】 — 原断句影响理解
【需审核:拼写错误】 — 原文疑似口误或拼写问题
【需审核:黑话含义】 — 黑话有多种解释
- 适合正式发布前的审核
输出格式:
## AI 模糊版本
[完整翻译内容]
## 人工审核版本
[带标注的翻译内容]
格式验证(强制步骤)
翻译完成后,必须运行格式验证确保输出与原版完全一致。
验证内容
| 检查项 | 说明 |
|---|
| 序号一致 | 翻译文件序号与原版完全匹配 |
| 时间线一致 | 每条时间线与原版完全相同 |
| 时间线格式 | 00:00:00,000 --> 00:00:05,000 格式正确 |
| 条数一致 | 翻译条数 = 原版条数 |
| 编码检查 | 无乱码或异常字符 |
验证命令
python scripts/validate_srt.py <原版.srt> <翻译.srt>
自动修复
如果验证失败,使用 --repair 参数自动修复:
python scripts/validate_srt.py <原版.srt> <翻译.srt> --repair
修复逻辑:
- 使用原版时间线重建翻译文件
- 缺失条目标记为
【翻译缺失】
- 输出
.repaired.srt 文件
验证失败示例
❌ 格式验证失败:
缺少序号: [93]
序号 93: 时间线不匹配
原版: 00:08:57,420 --> 00:09:03,280
翻译: 00:09:03,280 --> 00:09:09,380
条数不匹配: 原版 260 条, 翻译 259 条
工作流程
短文本(<100 条字幕)
1. 识别输入类型(SRT 或文本)
2. 加载术语对照文件
3. 翻译处理:
- 查找术语 → 参照对照表
- 遇到黑话 → 保留+括号解释
- 断句处理 → 查看上下文
4. 输出两种版本
5. 【强制】运行格式验证 → 修复问题
长文本(≥100 条字幕)— 分段翻译
长字幕文件会导致 LLM 上下文丢失,采用分段预处理 + 滑动窗口方案:
1. 运行 preprocess_srt.py 预处理:
- 将字幕分段(默认 50 条/段)
- 每段扫描出现的术语,生成术语摘要
- 输出分段内容 + 术语摘要
2. 分段翻译:
- 每段附带术语摘要,确保翻译风格一致
- 前一段翻译结果作为下一段的参考
- 保持术语处理的一致性
3. 合并输出:
- 按序号合并分段翻译
- 保持时间线和格式完整
4. 【强制】运行格式验证 → 修复问题
预处理命令:
python scripts/preprocess_srt.py <srt_file> [chunk_size]
建议分段大小:
- 简单字幕(少量术语):100 条/段
- 技术字幕(大量术语):30-50 条/段
Resources
scripts/
处理脚本:
| 脚本 | 用途 | 使用时机 |
|---|
preprocess_srt.py | SRT 分段预处理,生成术语摘要 | 长文本翻译前 |
validate_srt.py | 格式验证 + 自动修复 | 翻译完成后(强制) |
典型工作流:
python scripts/preprocess_srt.py input.srt 50
python scripts/validate_srt.py input.srt output.srt
python scripts/validate_srt.py input.srt output.srt --repair
references/
术语对照文件(翻译时加载):
abilities_translation.json — 技能对照
trees_translation.json — 天赋对照
pvp_translation.json — PVP天赋对照
wow_slang.json — 黑话术语对照
assets/samples/
翻译风格参考(首次使用时参照):
en0.srt / cn0.srt
en2.srt / cn2.srt