ワンクリックで
qwen-tts-audio
使用本地 Qwen3-TTS 常驻 worker 生成日语或多语言语音,并按请求从 voice-references 选择不同角色、参考音频和情绪参数。适用于多个会话共享同一 worker。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
使用本地 Qwen3-TTS 常驻 worker 生成日语或多语言语音,并按请求从 voice-references 选择不同角色、参考音频和情绪参数。适用于多个会话共享同一 worker。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
当需要运行或记录一个 OumuQ 兼容的阿里云百炼 / DashScope 云端 TTS worker 时使用。支持真正的 Qwen 声音设计、经授权的声音复刻、动态多角色和全局串行播放。
通过阿里云百炼 / DashScope 的 Qwen TTS API 生成语音,并让一个常驻 worker 按请求在多个角色与会话之间安全切换。支持 Qwen 声音设计、个人非商业用途的声音复刻、已有 voice_id 和 OumuQ 全局串行播放。
当需要规划 Qwen/DashScope 克隆声线注册、语言提示,或处理跨语言语音时使用,例如日语参考音频说中文。尤其适用于用户还没有明确想要的语音语言和口音取舍时。
当用户希望 Codex 聊天回复既保持选定角色风格、又通过 TTS 播放时使用。覆盖所有可见 Codex 输出、从 voice-references 选择角色人格/风格、先提交语音再显示文本、语音语言和屏幕语言不同的情况、支持时的情绪提示、工作区归属的缓存/输出,以及 UTF-8 中文路径。
从中文 Wiki、网页、本地资料、角色设定或参考音频中提取角色人格、语言风格和 TTS 参数,创建或更新 OumuQ 的 voice-references 角色条目。角色 TTS 或声音克隆任务应先把可用参考音频提取到本机私有目录,再按用户选择使用本地或千问克隆;skill、代码和脱敏模板可以发布,但真实 TTS 参考音频不得放到 GitHub 或公网地址。用户要求创建、添加、注册、提取或还原角色,制作中文角色提示词、语音角色、音色克隆配置或对话模式角色时使用。
当 Agent 需要从 voice-references 中选择 OumuQ 兼容的本地 TTS worker、语言、角色、固定声线、参考音频或播放行为时使用。
| name | qwen-tts-audio |
| description | 使用本地 Qwen3-TTS 常驻 worker 生成日语或多语言语音,并按请求从 voice-references 选择不同角色、参考音频和情绪参数。适用于多个会话共享同一 worker。 |
使用本地 Qwen3-TTS 常驻 worker。worker 脚本和参考音频解析器都随本 Skill 安装:
%USERPROFILE%\.codex\skills\qwen-tts-audio\scripts\qwen_tts_worker.py%USERPROFILE%\.codex\skills\qwen-tts-audio\scripts\voice_reference.pycharacter_id 的交错请求。character_id;不要依赖上一条请求。session_id 可用于直接 worker 调试记录;经 OumuQ 时由 OumuQ 自己保存关联记录。如果旧 worker 只能固定单一 prompt audio,应给不同角色分配独立端口,不能反复重启共享端口。
从拥有缓存与输出目录的工作区启动:
$worker = Join-Path $env:USERPROFILE '.codex\skills\qwen-tts-audio\scripts\qwen_tts_worker.py'
Start-Process -FilePath '<qwen-python>' -ArgumentList @(
'-X','utf8',
$worker,
'--workdir',(Get-Location).Path,
'--model','<model-or-snapshot>',
'--host','127.0.0.1',
'--port','8765',
'--max-new-tokens','192'
) -WorkingDirectory (Get-Location).Path -WindowStyle Hidden -PassThru
<qwen-python> 和模型位置属于本机配置,不要写死到公开 Skill。
优先经 OumuQ:
{
"session_id": "session-a",
"character_id": "jp_companion",
"text": "こんばんは。",
"language": "Japanese",
"play": true,
"emotion_tags": ["warm"],
"match_patterns": ["greeting"]
}
直接 worker fallback 也可以额外传:
character_folderprompt_audio / prompt_audiosemotion_vectorref_textmax_new_tokensworker 在每个请求中从该角色的 voice-index.json 选择参考音频,并把选择结果写入 job 快照。角色请求没有显式 ref_text 时,不继承进程启动时属于另一个角色的 --ref-text;它会使用安全的 x-vector-only 模式。只有不带角色身份的 legacy 请求才可使用进程默认 ref_text。
生成音频、组合 prompt、缓存和日志都必须位于工作区输出目录,不能写回 voice-references。