Skip to main content

fish-speech-tts

Fish Speech — modelo TTS de última generación con clonación de voz zero-shot y alta calidad.

インストールへ移動

ソース情報

リポジトリ
Ntizar/MasterMind
ソースの最終更新活動
2026年9月4日 10:27
検出された SKILL.md の言語
スペイン語
スター
2
フォーク
0

インストール方法

デフォルトでは、最初にソースを確認する Prompt が選択されています。直接コマンドに切り替えるか、ローカルコピーをダウンロードすることもできます。

ソースファイルを確認

インストールを決める前に、SKILL.md と SkillsMP に表示されている付属ファイルをお読みください。

SKILL.md を表示中

SKILL.md
ソースの指示 · 読み取り専用プレビュー
name
fish-speech-tts
description
Fish Speech — modelo TTS de última generación con clonación de voz zero-shot y alta calidad.
category
media
# Fish Speech — TTS de Nueva Generación ## Qué es Fish Speech de Fish Audio es un sistema TTS que ofrece: - **Zero-shot cloning** — clonar voz con muestras cortas - **Alta calidad** — audio natural y expresivo - **Multilingüe** — soporte para múltiples idiomas - **Open source** — completamente abierto ## Instalación ```bash git clone https://github.com/fishaudio/fish-speech.git cd fish-speech pip install -e . ``` ## Uso básico ```python # Generar audio con voz clonada # Usar el CLI o API proporcionada fish-speech --text "Texto a sintetizar" --reference "reference.wav" --output "output.wav" ``` ## Casos de uso - **Narración personalizada** — voz de David para contenido - **Doblaje** — mantener timbre consistente - **Prototipado rápido** — generar audio para tests ## Pitfalls - Requiere GPU para inference rápida - Modelos grandes (varios GB) - La configuración inicial puede ser compleja - Depende de modelos pre-entrenados de HuggingFace ## Referencias - Repo: `github.com/fishaudio/fish-speech` (31K⭐) - HuggingFace: `https://huggingface.co/fishaudio` ## Comparativa de alternativas - **[fishaudio/fish-speech](https://github.com/fishaudio/fish-speech)** — Fish Speech 1.5 (Apache-2.0) es la referencia de TTS con clonación expresiva *zero-shot* en ~0.5 s de audio y salida en tiempo real; frente a otros clones de voz, destaca por calidad expresiva con muy poco audio de referencia.
GitHubで見る