Skip to main content

fish-speech-tts

Fish Speech — modelo TTS de última generación con clonación de voz zero-shot y alta calidad.

설치로 이동

소스 정보

저장소
Ntizar/NtizarBrainMasterMind
최근 소스 활동
2026년 7월 16일 08:02
감지된 SKILL.md 언어
스페인어
스타
2
포크
0

설치 방법

기본적으로 소스를 먼저 확인하는 Prompt가 선택됩니다. 직접 명령으로 전환하거나 로컬 사본을 다운로드할 수도 있습니다.

소스 파일 검토

설치 여부를 결정하기 전에 SKILL.md와 SkillsMP에 표시된 보조 파일을 읽어 보세요.

SKILL.md 표시 중

SKILL.md
소스 지침 · 읽기 전용 미리보기
name
fish-speech-tts
description
Fish Speech — modelo TTS de última generación con clonación de voz zero-shot y alta calidad.
category
media
# Fish Speech — TTS de Nueva Generación ## Qué es Fish Speech de Fish Audio es un sistema TTS que ofrece: - **Zero-shot cloning** — clonar voz con muestras cortas - **Alta calidad** — audio natural y expresivo - **Multilingüe** — soporte para múltiples idiomas - **Open source** — completamente abierto ## Instalación ```bash git clone https://github.com/fishaudio/fish-speech.git cd fish-speech pip install -e . ``` ## Uso básico ```python # Generar audio con voz clonada # Usar el CLI o API proporcionada fish-speech --text "Texto a sintetizar" --reference "reference.wav" --output "output.wav" ``` ## Casos de uso - **Narración personalizada** — voz de David para contenido - **Doblaje** — mantener timbre consistente - **Prototipado rápido** — generar audio para tests ## Pitfalls - Requiere GPU para inference rápida - Modelos grandes (varios GB) - La configuración inicial puede ser compleja - Depende de modelos pre-entrenados de HuggingFace ## Referencias - Repo: `github.com/fishaudio/fish-speech` (31K⭐) - HuggingFace: `https://huggingface.co/fishaudio`
GitHub에서 보기