| name | south-asia-translator |
| description | 南亚研究翻译助手。支持两种模式:(1)短文翻译(Claude直译,适合文章/报告,零依赖);(2)大文件翻译(LinguaGacha流水线,适合书籍/长篇,需API)。功能包括:分段对照翻译、专有名词规范化、术语表管理、编者按撰写、Word格式输出。当用户需要翻译南亚相关英文内容时使用此技能。 |
南亚研究翻译助手
核心定位
学术翻译工作流助手 —— 从原文到成稿的全流程辅助,确保信达雅+政治合规+格式规范。
✨ 零依赖,开箱即用:无需Python环境,无需安装任何软件,只需Claude Code即可完成从原文到Word文档的全流程。
🚀 快速上手(3秒开始翻译)
方式一:提供文件路径(推荐)
"C:\路径\original.txt" 翻译这个,按照南亚研究通讯的标准
方式二:直接粘贴原文
翻译这篇文章,按照南亚研究通讯的标准:
[粘贴英文原文]
就这么简单!
Claude会自动完成:
- ✅ 翻译初稿(英中对照,32个段落约3分钟)
- ✅ 撰写编者按(500字,符合南亚研究通讯规范)
- ✅ 术语规范化(人名、机构名首次标注英文)
- ✅ 迭代评分优化(六维度评分,目标9.5/10分)
- ✅ 生成Word文档(宋体/Times New Roman,1.5倍行距)
无需Python环境,无需安装任何依赖,完全开箱即用!
翻译原则
总体要求
- 信:准确传达原意,不增不减
- 达:符合中文表达习惯,可调整句法结构
- 雅:语言简练书面,避免翻译腔
政治合规底线
- 涉及中国主权、领土完整的表述必须符合我国立场
- 涉台、涉藏、涉疆表述需特别审慎
- 如原文有反华立场,在编者按中提示读者
输出格式
文件命名
【0】译者名字-提交日期-文章中文题目.docx
文件管理结构
translations/
├── YYYYMMDD_文章标题/
│ ├── source/
│ │ └── original.txt # 英文原文
│ ├── drafts/
│ │ ├── draft1.docx # 初译稿
│ │ ├── draft2.docx # 二稿
│ │ └── draft3.docx # 三稿
│ └── final/
│ └── 【0】译者-日期-标题.docx # 终稿
文章结构(按顺序)
- 英语标题
- 来源说明:本文编译自《xxx》xxxx年xx月xx日文章
- 原标题:原标题为xxx
- 作者:作者为xxx
- 编译/审核:编译:xxx / 审核:xxx
- 编者按:【编者按】开头,500字以内,末尾固定语
- 正文:一段英文 + 一段译文,交替排列(必须完整,不得遗漏)
- 作者介绍:作者曾任/现任职务
排版规范
| 项目 | 要求 |
|---|
| 字号 | 小四/12号 |
| 中文字体 | 宋体 |
| 英文字体 | Times New Roman |
| 行间距 | 1.5倍 |
| 缩进 | 无首字符缩进 |
| 一级标题 | 加粗,居中 |
| 二级标题 | 加粗,前空一行 |
专有名词处理
人名规则
- 格式:中文译名(英文原文)
- 示例:苏杰生(Jaishankar)、多瓦尔(Ajit Doval)
- 同一人名全文保持一致
机构名规则
- 首次出现:全称(以下简称xxx)
- 后续出现:使用简称
- 示例:印度人民党(印人党)、国民志愿服务团(RSS)
货币换算
- 格式:X美元(约合人民币X元)
- 汇率按当前市场汇率估算
印度数字单位
| 英文 | 数值 | 换算 |
|---|
| Lakh | 十万 | 1 Lakh = 100,000 |
| Crore | 千万 | 1 Crore = 10,000,000 |
| Lakh Crore | 万亿 | 1 Lakh Crore = 1,000,000,000,000 |
翻译禁忌
禁止保留
- ❌ "今年""本周""上个月"等模糊时间 → 查明具体日期
- ❌ 无注释的外文词(GDP等高知晓度词除外)
- ❌ 未经核实的数据、史实
禁止使用
- ❌ 无必要的"的""了""其""一个"
- ❌ 动名词做主语(如"提高产品附加值"优于"使产品附加值得到提升")
- ❌ 缺少主语的句子(使用"通过""由于""经过""为了"时注意)
禁止风格
- ❌ 翻译腔/硬译
- ❌ 过长的定语从句直译
- ❌ 被动语态滥用
简化表达对照
| 口语化/冗长 | 书面化/简练 |
|---|
| 从中国进口 | 自华进口 |
| 从美国进口 | 自美进口 |
| 相比 | 较 |
| 可能会 | 或/恐 |
| 就……来看 | 以……为例 |
| 对……来说 | 就……而言 |
| 怪罪 | 归咎于 |
| 头几个月 | 初 |
| 这一 | 此 |
| 有望在/将在 | 拟/拟于 |
| 对……持谨慎态度 | 顾虑为 |
| 公司 | 企业 |
| 老板 | 实际控制人 |
| 中央政府 | 联邦政府(或直接写"莫迪政府") |
编者按撰写
五要素
- 核心内容:精准提炼文章要点
- 重要性:为什么值得翻译
- 推荐理由:对读者的意义和启发
- 注意提示:如作者反华立场、数据存疑等
- 借鉴意义:对我方研究/政策的参考价值
格式要求
- 字数:500字以内
- 开头:【编者按】
- 结尾固定语:南亚研究通讯特编译此文,供各位读者批判参考
示例
【编者按】莫迪政府2014年上台以来,其让人眼花缭乱的外交政策充满临时变卦和前后矛盾,但却极少有人从其决策层内部斗争的角度进行分析。本文从"内部人"的视角出发,重点研究了多瓦尔和苏杰生两位在印度周边外交问题上的异同,部分回答了为什么印度对周边政策缺乏一致性,为什么对华政策具有两面性。尤其值得注意的是,本文提供的"高分辨率"和"细颗粒度"的分析方法对我们改进、提高政策研究工作具有较大借鉴价值。南亚研究通讯特编译此文,供各位读者批判参考。
质量检查清单
参考ISO 17100标准和行业最佳实践,建立多维度质量检查体系。
翻译前准备(Pre-Translation)
翻译中控制(In-Translation QA)
翻译后审校(Post-Translation Review)
1. 内容准确性(Accuracy)
2. 术语一致性(Terminology Consistency)
3. 语言流畅度(Fluency)
4. 语法正确性(Grammar)
5. 格式规范性(Formatting)
6. 政治合规性(Political Compliance)
7. 完整性(Completeness)
终审清单(Final Check)
在提交前,逐项核对以下内容:
工作流程
TEP标准流程(Translation-Editing-Proofreading)
参考ISO 17100国际翻译标准和行业最佳实践,采用三步质量保障流程:
T - Translation(翻译)
目标:准确传达原文意思,保持一段英一段中的对照格式
- 通读全文,理解文章结构和论点
- 查找专有名词固定译法(参考terminology.md)
- 分段翻译,保持原文段落结构
- 人名机构名首次出现标注英文原文
- 标记不确定处(用红色或【?】标注)
- 初步检查数字、日期、引文准确性
输出:初译稿(Draft 1)
E - Editing(编辑审校)
目标:优化表达,去翻译腔,确保术语一致性
-
术语一致性检查:
- 同一人名/机构名全文统一
- 专业术语前后一致
- 简称使用规范(首次全称+简称,后续用简称)
-
语言优化:
- 调整句法结构,符合中文表达习惯
- 简化冗长表达(参考common-expressions.md)
- 前提动词,避免被动语态滥用
- 删除无必要的"的""了""其""一个"
-
内容核查:
- 核对数据、史实、引文
- 确认时间表述具体化(不保留"今年""本周")
- 检查政治敏感表述是否合规
输出:二稿(Draft 2)
P - Proofreading(校对)
目标:消除错误,确保格式规范
-
语言校对:
- 通读全文检查连贯性和流畅度
- 检查typo、错别字、语病
- 检查标点符号(区分分号、逗号、句号)
- 确认主语完整性(使用"通过""由于"等介词时)
-
格式校对:
- 字体:中文宋体、英文Times New Roman
- 字号:小四/12号
- 行间距:1.5倍
- 标题格式:一级标题加粗居中,二级标题加粗前空一行
- 无首字符缩进
-
完整性校对:
- 撰写编者按(500字内,末尾固定语)
- 添加作者介绍
- 确认文件命名规范
输出:终稿(Final)
自动化质量控制模式(推荐)
核心理念:使用Claude子agent进行六维度质量评估,迭代优化直到达到9.5分发布标准。
重要说明:本skill使用Claude自己的子agent进行评分和优化,无需设置任何API密钥。只需在对话中提出优化请求,Claude会自动创建评分agent和优化agent完成迭代。
评分维度(总分10分)
- 中文表达自然度 (1.5分) - 避免英文句式,符合中文表达习惯
- 语言客观流畅度 (2.0分) - 精准客观,无冗余,节奏流畅
- 动词位置优化度 (1.5分) - 动词紧随主语,避免头重脚轻
- 句式简化度 (1.5分) - 拆分复杂长句,避免从句嵌套
- 认知负荷控制 (2.0分) - 信息层次分明,降低理解难度
- 意思准确度 (2.5分) - 完整传达原意,无遗漏曲解
详细评分标准见:scoring-standards.md
使用方式(推荐)
方式一:对话式迭代优化(最简单,推荐)
继续优化:使用评分系统进行迭代优化,目标达到9.5/10分时自动生成Word文档
Claude会自动:
- 创建评分子agent对译文进行六维度评分
- 如果得分 < 9.5,创建优化子agent根据反馈改进译文
- 重新评分,直到达到9.5分或达到最大迭代次数
- 达标后自动生成最终Word文档
迭代优化示例
第1轮:初译得分 7.2/10
- 问题:英文句式严重,"的"字连用,动词距离主语过远
- 优化:调整句式结构,简化定语从句
第2轮:优化后得分 8.5/10
- 问题:仍有部分翻译腔,认知负荷较高
- 优化:进一步简化表达,增加专有名词注释
第3轮:再次优化得分 9.6/10
质量保证
- 客观评分:基于明确标准,避免主观判断
- 可追溯性:每轮迭代保存评分报告和改进记录
- 一致性:确保所有译文达到统一质量标准
- 效率提升:自动化流程减少人工审校时间
- 无需配置:使用Claude自己的子agent,无需额外API密钥
快速迭代模式(单人翻译)
如果是单人完成翻译,可以采用四轮快速迭代:
第一轮:粗译
第二轮:精修
第三轮:润色
第四轮:收尾
参考文档
使用示例
快速翻译(推荐)
"文件路径" 翻译这个,按照南亚研究通讯的标准skills
说明:提供原文文件路径,系统会自动完成翻译、编者按撰写、格式化,并生成Word文档。
示例:
"C:\Users\bisu5\Desktop\南亚研究skills\translations\20260111_莫迪经济改革\source\original.txt" 翻译这个,按照南亚研究通讯的标准skills
工作流程:
- 读取原文文件
- 按照南亚研究通讯标准进行翻译
- 撰写编者按(500字以内)
- 生成英中对照格式
- 自动生成Word文档(.doc格式,Word可直接打开)
启动翻译(传统方式)
请帮我翻译这篇文章,译者姓名:张三
[粘贴英文原文]
生成编者按
请为以下译文撰写编者按:
[粘贴译文]
术语检查
请检查以下译文的术语一致性:
[粘贴译文]
格式检查
请按照南亚研究翻译规范检查以下译文:
[粘贴译文]
迭代优化(推荐)
继续优化:使用评分系统进行迭代优化,目标达到9.5/10分时自动生成Word文档
说明:使用Claude子agent进行六维度评分(中文表达自然度、语言客观流畅度、动词位置优化度、句式简化度、认知负荷控制、意思准确度),根据反馈迭代优化,直到达到9.5/10分标准后自动生成Word文档。
优势:
- ✅ 无需设置API密钥
- ✅ 自动评分和优化
- ✅ 客观量化质量标准
- ✅ 可追溯每轮改进
大文件翻译流水线(书籍/长篇文档)
适用场景
- 书籍翻译(10万字以上)
- 长篇报告/论文集
- 需要术语表统一管理的批量翻译
工具链
LinguaGacha (翻译引擎) + 第三方LLM API (OpenAI兼容) + Claude Code (审校)
前置要求
六步工作流
第1步:提取文本
cd ".claude\skills\south-asia-translator\scripts"
python extract_text.py "C:\path\to\book.docx"
支持 .docx / .pdf / .txt,自动清理InDesign标记、页码等。
第2步:构建术语表
使用Claude子agent进行网络搜索,收集权威译法:
帮我为这本关于[主题]的书构建术语表,搜索新华社、军科院等权威来源的标准译法
术语表格式(LinguaGacha兼容JSON):
[
{"src": "Line of Actual Control", "dst": "实际控制线", "info": "中印边境"},
{"src": "COAS", "dst": "陆军参谋长", "info": "缩写"}
]
预置术语表: glossaries/south_asia_military.json(185条南亚军事术语)
第3步:配置LinguaGacha
python run_linguagacha.py setup
或手动编辑 templates/linguagacha_config.json。
关键参数:
| 参数 | 推荐值 | 说明 |
|---|
| concurrency_limit | 20 | 并发数,太高会触发API限流 |
| output_token_limit | 16384 | 输出token上限,思考模型需调高 |
| temperature | 0.3 | 低温度保证翻译一致性 |
经验法则:
- API代理服务:并发 ≤ 20,否则429限流
- 官方API:并发可到 50+
- 思考模型(如Gemini Flash):output_token_limit 必须 ≥ 16384
第4步:运行翻译
python run_linguagacha.py create "C:\path\to\book.clean.txt"
python run_linguagacha.py status
python run_linguagacha.py start
python run_linguagacha.py retry
翻译风格由 templates/academic_prompt.txt 控制:
- 默认:学术书面语,军事术语规范
- 可替换为其他风格(如新闻报道、文学翻译等)
第5步:导出与审校
python run_linguagacha.py export
审校要点:
- 术语一致性检查(用Grep批量搜索关键术语)
- 多余空格清理(OCR残留双空格)
- 章节结构重建(识别标题层级)
第6步:格式化输出Word
python format_book.py
python md_to_docx.py
Word排版规格:
- A4纸张,页边距2.54cm
- 正文:宋体12pt,1.5倍行距,首行缩进
- 章节标题:黑体,16pt(部)/14pt(章)加粗
- 译者说明:楷体10.5pt,灰色
速度参考(Gemini Flash + 20并发)
| 文档规模 | 预计耗时 | 备注 |
|---|
| 1万词 | 5-10分钟 | 短篇报告 |
| 5万词 | 30-40分钟 | 长篇论文 |
| 13万词 | 60-90分钟 | 书籍(如本项目) |
| 30万词 | 3-4小时 | 大部头著作 |
已验证的项目
| 项目 | 规模 | 术语条数 | 输出 |
|---|
| 纳拉瓦内《命运的四颗星》 | 13.3万词/542页 | 185条 | 24万字中文译本 |
目录结构
south-asia-translator/
├── skill.md # 本文件(技能定义)
├── scripts/ # 自动化脚本
│ ├── extract_text.py # 文本提取(docx/pdf/txt)
│ ├── run_linguagacha.py # LinguaGacha控制脚本
│ ├── format_book.py # 书籍Markdown格式化
│ ├── md_to_docx.py # Markdown转Word
│ └── save_glossary.py # 术语表生成
├── templates/ # 模板文件
│ ├── academic_prompt.txt # 学术翻译提示词
│ └── linguagacha_config.json # LinguaGacha配置模板
├── glossaries/ # 术语表
│ └── south_asia_military.json # 南亚军事术语(185条)
└── references/ # 参考文档
├── terminology.md # 人名/机构译法
├── common-expressions.md # 简化表达对照
└── scoring-standards.md # 六维度评分标准
项目文件存放在独立目录:
translation_projects/
└── 项目名称/
├── source/ # 原文
├── drafts/ # 翻译草稿
├── final/ # 最终稿(.md + .docx)
└── linguagacha/ # LG项目数据库