用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/johnalbertini14-glitch/openclaw-skills --skill minimax命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
基于 SOC 职业分类
正在显示 SKILL.md
| name | MiniMax 多人对话语音合成 |
| description | 根据用户需求生成多人对话,为每个角色匹配音色进行语音合成,输出完整长音频和分段音频,并生成 HTML 展示页面。 |
| category | audio |
| tags | ["语音合成","TTS","多人对话","MiniMax","海螺"] |
| featured | true |
根据用户需求生成多人对话剧本,智能匹配角色音色,合成完整音频和分段音频,最终生成精美的 HTML 展示页面。
获取用户想要生成的对话主题或场景:
根据用户需求,创作一段自然流畅的多人对话。格式要求:
{
"title": "对话标题",
"scene": "场景描述",
"characters": [
{
"id": "A",
"name": "角色名称",
"gender": "male/female",
"age": "child/young/middle/elder",
"personality": "性格特点描述"
}
],
"dialogues": [
{
"speaker_id": "A",
"speaker_name": "角色名",
"text": "对话内容",
"emotion": "情绪标签"
}
]
}
调用 MCP 工具获取可用音色,然后根据角色特点匹配:
{
"server": "user-速推AI",
"toolName": "list_voices",
"arguments": {}
}
参考文档:详细的音色匹配规则见 references/voice-mapping.md
使用 AskQuestion 让用户确认或调整音色匹配:
请确认角色音色匹配:
角色 A (小明 - 年轻男学生):
推荐: male-qn-daxuesheng (青年大学生音色)
角色 B (李总 - 成熟商务男):
推荐: male-qn-jingying (精英青年音色)
是否确认?或选择调整某个角色的音色。
使用 speech-2.8-hd 模型时,根据情绪标签智能添加语气词增强情感表达。
参考文档:语气词使用规则见 references/emotion-tags.md
预处理示例:
原文:
小明:今天考试终于结束了!太开心了!
处理后:
小明:今天考试终于结束了(breath)!太开心了(laughs)!
为每段对话调用语音合成:
{
"server": "user-速推AI",
"toolName": "text_to_audio",
"arguments": {
"text": "处理后的对话文本(含语气词)",
"voice_id": "该角色的音色ID",
"model": "speech-2.8-hd",
"output_format": "url",
"language_boost": "Chinese"
}
}
参考文档:MCP 工具详细参数见 references/mcp-tools.md
speaker_id 获取对应音色text_to_audio 合成每段音频将所有分段音频合并为一个完整的长音频。有两种方式:
使用 scripts/merge_audio.py 脚本将所有分段音频合并成一个完整的长音频文件。
依赖安装:
pip install pydub requests
# macOS 安装 FFmpeg
brew install ffmpeg
基本用法:
# 从 dialogue.json 读取 URL 并合并
python scripts/merge_audio.py --input dialogue_output/dialogue.json --output dialogue_output/merged.mp3
# 自定义音频间隔(毫秒)
python scripts/merge_audio.py -i dialogue.json -o merged.mp3 --gap 500
# 保留分段音频文件
python scripts/merge_audio.py -i dialogue.json -o merged.mp3 --keep-segments --segments-dir ./segments
在 HTML 页面中实现自动顺序播放功能,模拟长音频效果(无需额外处理)。
使用模板生成精美的 HTML 展示页面。
将对话数据和音频 URL 填充到模板中的占位符:
{{title}} - 对话标题{{scene}} - 场景描述{{characters}} - 角色列表{{dialogues}} - 对话列表(含音频 URL)生成以下文件:
dialogue_output/
├── dialogue.html # 完整展示页面
├── dialogue.json # 对话数据(含音频 URL)
├── merged.mp3 # 合并后的完整长音频
└── segments/ # 分段音频(可选)
├── 001_角色A.mp3
├── 002_角色B.mp3
└── ...
生成长音频:
cd /Users/m007/codes/translate_api/.cursor/skills/minimax-tts
python scripts/merge_audio.py -i ../../../dialogue_output/dialogue.json -o ../../../dialogue_output/merged.mp3
帮我生成一段两个人讨论今天天气的对话,一男一女
1. 生成对话剧本
{
"title": "关于天气的闲聊",
"scene": "办公室午休时间,两位同事在茶水间偶遇",
"characters": [
{ "id": "A", "name": "小明", "gender": "male", "age": "young", "personality": "阳光开朗" },
{ "id": "B", "name": "小红", "gender": "female", "age": "young", "personality": "温柔细心" }
],
"dialogues": [
2. 匹配音色
| 角色 | 音色 ID | 音色名称 |
|---|---|---|
| 小明 | male-qn-qingse | 青涩青年音色 |
| 小红 | female-shaonv | 少女音色 |
3. 合成音频 → 为每段对话调用 text_to_audio
4. 生成 HTML → 填充模板,输出 dialogue.html
5. 输出结果
对话音频已生成!
📁 输出文件:
- dialogue.html - 展示页面(用浏览器打开)
- dialogue.json - 对话数据
🎭 角色音色:
- 小明: male-qn-qingse (青涩青年音色)
- 小红: female-shaonv (少女音色)
🎵 音频数量:4 段
⏱️ 预计总时长:约 30 秒
💡 提示:在浏览器中打开 dialogue.html 即可播放