원클릭으로
bytedance-tts
使用字节 Seed TTS 将 narration-plan.json 按片段合成为 WAV,并输出包含 slide_id、实际时长和停顿的 tts-manifest.json。用于口播视频配音、复刻音色分段合成和页面级音频对齐。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
메뉴
使用字节 Seed TTS 将 narration-plan.json 按片段合成为 WAV,并输出包含 slide_id、实际时长和停顿的 tts-manifest.json。用于口播视频配音、复刻音色分段合成和页面级音频对齐。
Codex 또는 Claude로 설치 이 Prompt를 복사해 Codex, Claude 또는 다른 어시스턴트에 붙여 넣으면 Skill 페이지를 검토하고 설치를 진행할 수 있습니다.
SOC 직업 분류 기준
将标准 HTML 幻灯片包、TTS 音频和 tts-manifest.json 制作为完整视频交付包,固定包含逐页渲染、MP4 合成、ASS 字幕与烧录、横竖双封面以及逐片段 QA。用于幻灯片视频的最终生产和交付,不限制上游使用 frontend-slides、Hyperframes 或其他 HTML 生成器。
调度多个原子 Skill,将中文文章、讲稿、脚本或录音转写文本制作为带配音、字幕、封面和 QA 的 HTML 幻灯片视频。用户要求文章转视频、文字转口播视频、制作 B 站知识视频或完整口播幻灯片交付包时使用;不负责音频转文字。
将 Markdown 笔记扩写为带 frontmatter、Obsidian 双链且已脱敏的正式技术文章。Use when 用户提供 md 文件路径并希望整理草稿或半结构化笔记;真实信息需用 mock 信息替代,同时保留数量、结构和技术含义。
Create stunning, animation-rich HTML presentations from scratch or by converting PowerPoint files. Use when the user wants to build a presentation, convert a PPT/PPTX to web, or create slides for a talk/pitch. Helps non-designers discover their aesthetic through visual exploration rather than abstract choices.
将冻结的 voiceover.md 转换为带稳定 slide_id、口播片段和页面停顿的 narration-plan.json。用于口播幻灯片分页、页面与语音对齐,或为可替换 HTML 幻灯片生成器建立统一内容契约。
将中文文章、讲稿、笔记、脚本或录音转写文本整理为忠于原文、自然可朗读的 voiceover.md。用户要求优化口播稿、清理转写文本、文章转口播,或其他工作流需要冻结唯一口播文本来源时使用。
| name | bytedance-tts |
| description | 使用字节 Seed TTS 将 narration-plan.json 按片段合成为 WAV,并输出包含 slide_id、实际时长和停顿的 tts-manifest.json。用于口播视频配音、复刻音色分段合成和页面级音频对齐。 |
读取 Skill 根目录的 env.json,运行时同名环境变量覆盖默认值。BYTE_TTS_API_KEY 必须由运行环境提供,不得输出到日志。
BYTEDANCE_TTS_SKILL_DIR="<加载后显示的 Skill 根目录>"
python3 "$BYTEDANCE_TTS_SKILL_DIR/scripts/segmented_tts.py" \
--output-dir "$OUTPUT_DIR" \
--plan "$OUTPUT_DIR/narration-plan.json" \
--output "$OUTPUT_DIR/voiceover.wav" \
--manifest "$OUTPUT_DIR/tts-manifest.json"
逐片段请求 TTS,只把正文发送给接口;页面停顿在本地插入真实静音。输出 WAV 和 manifest,保留输入中的 slide_id、segment_id 与文本,并记录实际音频时长。
详细接口约定见 references/bytedance-tts.md。