一键导入
voice-clone
使用 Confucius4-TTS Gradio API 做参考音色克隆和文本转语音。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
使用 Confucius4-TTS Gradio API 做参考音色克隆和文本转语音。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
使用全局 ~/.tmux.services 管理多个项目的常驻服务。支持注册、启动、精确重启、停止、查看状态与日志
启动 mock-ollama,将 OpenAI Chat Completions、Anthropic Messages、OpenAI Responses 三种协议代理到真实 LLM,并为 Claude Code、Codex/GPT-5.6 与 Cursor 提供本地接入和协议桥接。触发词:mock-ollama、启动 ollama mock、Claude 接第三方模型、Codex 接第三方模型、GPT-5.6 代理、Cursor BYOK、监控 LLM 请求
将回复生成 MP3 语音并通过 QQ 发送。用户要求语音回复、音频回复、朗读、“语音回复”、“发语音”、“读给我听”,或希望答案以语音形式交付时使用
用 Playwright 将网页或本地 HTML 渲染为高清 PNG 截图,支持全页、视口、分辨率和加载等待控制。用户提到 html-cut、cut-html、网页截图、HTML 截图、网页转 PNG、全页长截图时使用。
创建、定制并运行零依赖的临时局域网聊天室,支持浏览器聊天、文件传输、粘贴图片与桌面/移动端响应式布局。用户需要局域网聊天页、临时 Wi-Fi 文件共享,或修改内置聊天 UI 时使用。
把 Markdown 文件渲染成手机友好的 HTML,再调用 html-cut 截图为高清 PNG。用户提到 md-to-png、md 转 png、md 截图、把 md 发到手机看时使用。
| name | voice-clone |
| description | 使用 Confucius4-TTS Gradio API 做参考音色克隆和文本转语音。 |
| version | 1.0.0 |
| dependencies | ["python3"] |
| repository | https://github.com/gitByEOS/open-part-skills |
用 Confucius4-TTS 在线 Demo API,把文本合成为参考音色语音。
默认参考音色:
assets/miss-arrogant.mp3
在本 Skill 目录执行:
python3 scripts/confucius4_tts.py --text "你好,这是一次声音克隆测试。" --out output.wav
使用文本文件:
python3 scripts/confucius4_tts.py --text-file input.txt --out output.wav
指定参考音色:
python3 scripts/confucius4_tts.py \
--reference /path/to/reference.mp3 \
--text-file input.txt \
--out output.wav
| 参数 | 默认 | 说明 |
|---|---|---|
--text <text> | 空 | 要合成的文本 |
--text-file <path> | 空 | 从文件读取要合成的文本 |
--reference <path> | assets/miss-arrogant.mp3 | 参考音色 |
--lang <code> | zh | 语言代码 |
--out <path> | voice-clone-output.wav | 输出音频 |
--base-url <url> | Confucius4-TTS Demo | Gradio 服务地址 |
--text 和 --text-file 必须提供一个;同时提供时优先使用 --text。
当用户要合成语音时:
python3 scripts/confucius4_tts.py