一键导入
minimax-speech
MiniMax 语音合成技能 - 支持同步/异步文本转语音(T2S)、音色克隆(Voice Clone)、音色设计(Voice Design)、音色查询与删除。使用模型 speech-2.8-hd,输出 mp3/wav/pcm 格式音频文件到本地。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
MiniMax 语音合成技能 - 支持同步/异步文本转语音(T2S)、音色克隆(Voice Clone)、音色设计(Voice Design)、音色查询与删除。使用模型 speech-2.8-hd,输出 mp3/wav/pcm 格式音频文件到本地。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
MiniMax 图片生成技能 - 支持文生图(Text-to-Image)、图生图(Image-to-Image)。支持多种宽高比(1:1/16:9/9:16/4:3/3:4),返回 URL 或 Base64 格式,可下载保存到本地。
MiniMax 音乐生成技能 - 支持歌词生成(Lyrics Generation)、音乐生成(Music Generation)。支持自定义歌词段落结构(verse/chorus/bridge/intro/outro),异步生成 MP3 格式音乐,自动下载保存到本地。
MiniMax 视频生成技能 - 支持文生视频(Text-to-Video)、图生视频(Image-to-Video)、首尾帧视频(Frame-to-Frame)、主体参考视频(Subject-to-Video)。使用模型 MiniMax-Hailuo-2.3,默认生成 5 秒 720P MP4 视频,自动下载保存到本地。
| name | minimax-speech |
| description | MiniMax 语音合成技能 - 支持同步/异步文本转语音(T2S)、音色克隆(Voice Clone)、音色设计(Voice Design)、音色查询与删除。使用模型 speech-2.8-hd,输出 mp3/wav/pcm 格式音频文件到本地。 |
| version | 1.0.0 |
| author | laowang |
| tags | ["minimax","speech","tts","voice-clone","voice-design","audio"] |
使用 MiniMax API 进行语音合成、语音克隆和音色设计。支持同步/异步文本转语音、音色克隆、音色设计、音色查询与删除。使用模型 speech-2.8-hd,输出 mp3/wav/pcm 格式音频文件。
{
"MINIMAX_API_KEY": "your-api-key",
"MINIMAX_REGION": "cn" | "int"
}
MINIMAX_API_KEY: MiniMax API 密钥MINIMAX_REGION: 区域设置,cn 为中国,int 为国际(默认 cn)同步文本转语音
参数:
text: 要转换的文本voice_id: 音色ID(默认: female-tianmei)output_file: 输出文件路径示例: text_to_speech("你好世界", "female-tianmei", "hello.mp3")
异步文本转语音,返回任务ID
参数:
text: 要转换的文本voice_id: 音色ID返回: 任务ID
查询异步任务状态
参数:
task_id: 任务ID返回: 任务状态信息
音色快速复刻
参数:
audio_file_path: 参考音频文件路径title: 新音色名称返回: 新音色的 voice_id
音色设计
参数:
text: 音色描述文本style: 音色风格返回: 设计生成的 voice_id
获取音色列表
返回: 音色列表
获取单个音色信息
参数:
voice_id: 音色ID删除音色
参数:
voice_id: 音色ID返回: 是否成功
| 音色ID | 描述 |
|---|---|
| female-tianmei | 女声甜美 |
| male-yunyang | 男声播音 |
| female-badu | 女声巴度 |
| male-shawn | 男声 Shawn |
| female-shanshan | 女声杉杉 |
python scripts/speech.py tts "欢迎使用 MiniMax 语音服务" -v female-tianmei -o output.mp3
python scripts/speech.py tts-async "这是一段较长的文本" -v male-yunyang
python scripts/speech.py query <task_id>
python scripts/speech.py clone reference_audio.mp3 -t "我的音色"
python scripts/speech.py design "温柔的女性声音,适合朗读" -s gentle
python scripts/speech.py delete <voice_id>