| name | article-slide-video |
| description | 调度多个原子 Skill,将中文文章、讲稿、脚本或录音转写文本制作为带配音、字幕、封面和 QA 的 HTML 幻灯片视频。用户要求文章转视频、文字转口播视频、制作 B 站知识视频或完整口播幻灯片交付包时使用;不负责音频转文字。 |
文章口播幻灯片视频调度器
只负责编排和交付物校验,不在本 Skill 内实现文本编辑、TTS、HTML 渲染、字幕或视频脚本。
输出目录
读取本 Skill 根目录 env.json。默认输出到 ARTICLE_SLIDE_VIDEO_OUTPUT_ROOT/<输入文件名或安全主题名>/;用户明确指定输出目录时覆盖默认值。所有中间产物和交付物都写入该目录,禁止写到输入文件旁边。
调度流程
- 创建输出目录。
- 加载并调用
voiceover-editor,生成冻结的 voiceover.md。
- 加载并调用
slide-narration-planner,生成 narration-plan.json。
- 选择 HTML 幻灯片生成器:用户指定时使用指定工具,否则默认
frontend-slides。一般只生成一种风格;只有用户明确要求比较或并行候选时才生成多个。
- 要求生成器输出
deck.html、deck-manifest.json,实现 window.__SLIDE_VIDEO__,并使用 narration plan 中的原始 slide_id。加载 slide-video-delivery 后读取其 references/deck-contract.md。
- 加载并调用
bytedance-tts,生成 voiceover.wav 和 tts-manifest.json。
- 校验 narration、deck、TTS 三份数据中的
slide_id 集合一致。
- 加载并调用
slide-video-delivery,一次性完成帧渲染、视频、字幕、封面和 QA。
- 必须传入
voiceover.md、deck-manifest.json、tts-manifest.json、voiceover.wav 和输出目录。
slide-video-delivery 会使用 voiceover.md 中的标题和副标题生成封面。
- 封面必须由
imagegen 生成,严禁使用 HTML 截图或机械裁切。
- 执行前确认
slide-video-delivery 的 env.json 中已配置 OPENAI_BASE_URL 和 OPENAI_API_KEY(凭据通过环境变量注入,不写入文件)。
- 检查
delivery-report.json 中所有视觉状态已由执行者更新为 passed;失败时只重跑受影响阶段。
幻灯片生成器替换原则
不得让下游代码识别 .slide、.active、特定路由或生成器名称。Frontend Slides、Hyperframes 或其他 HTML 生成器都通过标准 manifest 和浏览器桥接接入。切换生成器只影响第 4、5 步。
最终交付
最终回复包含输出目录、voiceover.md、deck-manifest.json、最终字幕视频、横屏封面和竖屏封面的绝对路径,以及时长、分辨率、音频、字幕、横竖封面和逐片段 QA 状态。