| name | jimeng-storyboard |
| description | 将口播视频剧本拆解为即梦AI数字人平台的分镜头脚本。输出格式为每个镜头的角色说(台词)和动作描述(镜头语言/数字人动作),适配即梦 jimeng.jianying.com 数字人视频生成界面。触发场景:用户需要生成口播视频分镜、数字人视频剧本拆解、即梦分镜脚本、短视频口播脚本分镜、数字人台词加动作拆分。 |
| author | Daniel Li |
即梦数字人分镜脚本生成
将口播剧本按即梦AI数字人界面格式拆解为分镜头脚本,每个镜头包含"角色说"和"动作描述"两个字段。
即梦界面字段说明
参考 references/jimeng-format.md 了解即梦数字人界面的完整字段说明。
分镜拆解规则
1. 确定总时长与镜头数
| 总时长 | 推荐镜头数 | 每镜头时长 |
|---|
| 15-30秒 | 2-4个 | 6-12秒 |
| 30-60秒 | 4-6个 | 6-12秒 |
| 60-90秒 | 6-9个 | 8-12秒 |
| 90-180秒 | 9-18个 | 8-12秒 |
2. 台词拆分原则
- 按语义段落自然断句,每段一个完整观点
- 每个镜头台词控制在 15-36字(对应约5-12秒口播)
- 估算方式:中文口播约 3字/秒
- 硬限制:单镜头不超过36字 / 12秒,超过必须拆分
- Hook镜头(开头)台词要短而有力,≤20字
- CTA镜头(结尾)台词简洁,≤25字
3. 动作描述规范
动作描述用于指导数字人的表演和镜头语言,格式参考:
常用动作词汇:
- 表情:微笑、严肃、惊讶、自信地说、认真地讲
- 手势:双手摊开、竖起食指、比"1"的手势、双手交叉
- 身体:微微前倾、靠向椅背、转向镜头、点头
- 镜头:镜头推进、镜头缓慢拉远、正面中景、特写
动作描述模板:
[镜头类型],[数字人表情/动作],[附加镜头语言]
示例:
正面中景,数字人微笑看向镜头,自信地说
镜头缓慢推近,数字人表情严肃,竖起食指强调
中景,数字人双手摊开,语气轻松地解释
镜头微推,数字人微微前倾,认真地对镜头说
输出格式
按以下格式输出每个镜头,方便直接复制到即梦界面:
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
🎬 分镜脚本 — [主题名称]
总时长:约XX秒 | 共X个镜头
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
【镜头1】⏱️ 约Xs
📢 角色说:[台词内容]
🎭 动作描述:[动作+镜头描述]
【镜头2】⏱️ 约Xs
📢 角色说:[台词内容]
🎭 动作描述:[动作+镜头描述]
...
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
📌 操作指引:
1. 打开即梦 → 数字人
2. 选择对应数字人形象
3. 逐个镜头填入"角色说"和"动作描述"
4. 生成并下载每段视频
5. 使用 video-merge-send skill 合并视频并发送
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
剧本风格适配
根据田总内容调性生成剧本:
- 实战派:用具体数据和案例,不说空话
- 通俗化:老板听得懂的语言,不堆术语
- 合规先行:避免夸大承诺、绝对化用语
- 案例驱动:多用"比如"、"举个例子"引入场景
完整工作流
- 用户提供 主题 + 总时长
- 先用 video-marketing skill 生成完整剧本(如已有剧本则跳过)
- 按本skill规则拆解为分镜脚本
- 用户在即梦网页逐镜头生成并下载视频
- 用 video-merge-send skill 合并 + 发飞书