Skip to main content

openvoice-voice-cloning

OpenVoice — cloning de voz instantánea con transferencia de habla multi-idioma y control granular del estilo.

跳到安装

来源信息

仓库
Ntizar/NtizarBrainMasterMind
最近来源活动
2026年7月16日 08:02
检测到的 SKILL.md 语言
西班牙语
星标
2
分支
0

安装方式

默认使用会先检查来源的 Prompt;你也可以切换为直接命令,或下载本地副本。

检查来源文件

决定是否安装前,请先阅读 SKILL.md,以及 SkillsMP 当前展示的配套文件。

正在显示 SKILL.md

SKILL.md
来源说明 · 只读预览
name
openvoice-voice-cloning
description
OpenVoice — cloning de voz instantánea con transferencia de habla multi-idioma y control granular del estilo.
category
media
# OpenVoice — Voice Cloning Instantáneo ## Qué es OpenVoice de MyShell es un sistema de voice cloning que permite: - **Clonación instantánea** — una muestra de audio de 3 segundos es suficiente - **Transferencia multi-idioma** — clonar voz y hablar en idiomas diferentes - **Control granular** — ajustar acento, entonación, estilo emocional - **Ligero** — corre en CPU, no necesita GPU ## Instalación ```bash # Clonar y instalar git clone https://github.com/myshell-ai/OpenVoice.git cd OpenVoice pip install -e . # Descargar modelos de checkpoint # https://huggingface.co/myshell-audio/OpenVoice ``` ## Uso básico ```python from openvoice import se_extractor from openvoice.api import ToneColorConverter # 1. Extraer speaker embedding de la referencia se = se_extractor.get_se("reference.wav", save_path="embedded.pt") # 2. Convertir voz converter = ToneColorConverter('checkpoint_v1') converter.to("source.wav", "output.wav", se_path="embedded.pt") ``` ## Control de estilo ```python # Cambiar tono, velocidad, emoción # Usar tone color checkpoints predefinidos # https://github.com/myshell-ai/OpenVoice/tree/main/checkpoints_v2 ``` ## Casos de uso para David - **TTS personalizado** — clonar su propia voz para narraciones - **Accesibilidad** — generar voz con su timbre para contenido - **Doblaje** — mantener la voz del actor en traducciones - **Contenido multimodal** — audio + video con voz consistente ## Pitfalls - La calidad depende de la muestra de referencia (audio limpio, sin ruido) - No funciona bien con voces con acento muy fuerte en la referencia - Los checkpoints v2 son mejores que v1 - Requiere Python 3.9+ - El proceso de clonación es ~10-30 segundos por muestra de 5 segundos ## Referencias - Repo: `github.com/myshell-ai/OpenVoice` (36K⭐) - Docs: `https://docs.myshell.com` - Modelos: `https://huggingface.co/myshell-audio/OpenVoice`
在 GitHub 查看