Skip to main content

audio-pipeline

星标9
分支5
更新时间2026年5月3日 05:55

Audio pipeline: transcription (Whisper), TTS (ElevenLabs), audio extraction (ffmpeg), and YouTube transcript via MCP. [WHAT] Audio skill for transcribe, TTS, voice-over, podcast workflow. Whisper for transcription (default OpenAI Whisper, configurable per-language), ElevenLabs for TTS, ffmpeg for extraction, YouTube-transcript MCP for video. [WHEN] Use when: transcribe, audio, TTS, voice-over, podcast, YouTube transcript, generate speech, read aloud, dictation audio, mp3, wav, m4a. [LANGUAGE] Configurable. TTS voice configurable per project.

安装

用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。

SKILL.md
readonly