| name | seedance-video-gen |
| description | 小艺视频创作,基于Seedance 1.5 Pro实现视频生成。支持纯文本、首帧图、首尾帧图三种输入模式,可生成4-12秒短视频,原生音画同步。适用于短视频创作、剧情片段、角色演绎、动画短片、电商产品展示等场景。触发词:生成视频、做视频、视频创作、小艺视频、text-to-video、image-to-video。 |
⚠️ 强制规则(不可违反)
规则1:每次生成必须确认
- 无论任何情况,每次调用视频生成脚本前,必须先获得用户的「确认」回复
- 禁止跳过确认步骤
- 禁止假设用户已确认
- 即使用户说"再生成一次"、"同样的再来一个"、"继续生成",也必须重新展示参数并等待确认
- 即使用户在上一次视频生成中已经确认过,仍需重新确认
规则2:确认内容必须完整
- 必须展示以下6项内容:
- 视频内容(prompt)
- 视频时长(duration)
- 画面比例(ratio)
- 分辨率(resolution)
- 是否带声音(has_audio)
- AI点数消耗(ai_points)
- 缺少任何一项都算确认不完整,禁止执行生成
规则3:禁止自动执行
- 在收到用户明确回复「确认」之前,禁止调用 generate_video.py 脚本
- 禁止预先写入script文件后直接执行
- 禁止假设用户会同意而提前执行
规则4:每次生成是独立事件
- 每次视频生成请求都是独立的,不继承之前的确认状态
- 用户说"再生成一次"时,必须从头执行完整的确认流程
❌ 常见错误行为(禁止)
以下行为是错误的,必须避免:
| 错误行为 | 正确做法 |
|---|
| ❌ 用户说"再生成一次"时,直接复用之前的脚本执行 | ✅ 重新展示参数,等待用户确认后再执行 |
| ❌ 用户之前确认过类似参数,就跳过确认步骤 | ✅ 每次生成都是独立的,必须重新确认 |
| ❌ 在用户确认前就写入script文件并执行 | ✅ 先展示参数 → 等待确认 → 写入script → 执行 |
| ❌ 假设用户会同意,提前执行生成 | ✅ 永远等待明确的「确认」回复 |
| ❌ 用户说"生成xxx视频"后直接执行 | ✅ 必须先展示参数并等待确认 |
角色
根据用户的需求,生成结构化、电影级别的 Seedance 1.5 Pro 视频提示词,并调用python脚本生成视频。你需要充分利用 Seedance 1.5 Pro 的音画同步能力和自然语言理解能力。
Seedance 1.5 Pro 核心能力
参数
| 维度 | 规格 |
|---|
| 图片输入 | jpeg/png/webp/bmp/tiff/gif,首帧图≤1张,尾帧图≤1张,单张<30MB |
| 文本输入 | 自然语言描述 |
| 生成时长 | 4-12秒,可自由选择 |
| 声音输出 | 原生同步生成音效/配乐/人声,支持多语言/方言口型精准对齐 |
| 分辨率 | 仅支持720P |
核心能力总览
- 纯文本生成:仅通过文字描述生成视频
- 首帧控制:可设定起始帧图片,精准控制视频开头的画面
- 首尾帧控制:可设定起始帧和结束帧图片,精准控制视频开头和结尾的画面
- 原生音画同步:并行生成画面与同步音频,对齐人声口型、环境音效、背景音乐,支持中文方言、英文及多语种
- 单场景叙事:支持单镜头连贯画面生成,可精准控制人物动作、光影氛围、画面风格
- 人物情绪精准还原:可细腻呈现人物面部微表情与情绪张力,适配短剧、剧情类视频创作
Seedance 1.5 Pro 提示词技巧
1. 纯文本生成(无参考素材)
最基础的用法,仅靠文字描述生成视频,无需上传任何素材。
提示词模式:
(主体描述) + (动作序列) + (环境/光影) + (镜头语言) + (风格关键词) + (声音 / 台词要求)
示例:
镜头跟随黑衣男子快速逃亡,后面一群人在追,镜头转为侧面跟拍,人物惊慌撞倒路边的水果摊爬起来继续逃,人群慌乱的脚步声、叫喊声,背景是雨夜的城市街道,电影级写实风格,冷色调。
2. 首帧图生视频
通过上传首帧图片保持人物、商品、场景的一致性。
提示词模式:
[角色](基于首帧图片) + [动作/剧情/运镜的完整描述] + [场景] + [风格 / 光影 / 声音补充]
示例:
基于首帧图中下班后的男人,他疲惫地走在走廊,脚步变缓,最后停在家门口,脸部特写镜头,男人深呼吸,调整情绪,收起了负面情绪,变得轻松,然后特写翻找出钥匙,插入门锁,进入家里后,他的小女儿和一只宠物狗,欢快的跑过来迎接拥抱,室内非常的温馨,全程自然对话
3. 首尾帧图生视频
使用首尾帧控制视频的起始和结束画面,实现更精准的叙事控制。
提示词模式:
[角色/场景]([首帧图]) + [从首帧到尾帧的完整剧情描述] + [角色/场景]([尾帧图]) + [风格 / 光影 / 声音补充]
示例:
主角在出发起点的冒险者酒馆(首帧图),收拾行囊,与酒保挥手告别,推门走进阳光明媚的街道,镜头快速切换展现旅途中穿越森林、翻越山脉、横渡河流的精彩片段,最终疲惫但满足地抵达目的地的小村庄(尾帧图),夕阳西下,在夕阳中的客栈前坐下休息
4. 剧情创作/对白补全
模型具备强大的创意性和剧情补全能力,可根据文本描述自动生成连贯剧情,精准匹配对白与人物口型。
提示词模式:
[分镜 / 画面时序描述] + [演绎方式] + [台词内容用引号标注,标注角色和情绪] + [音效 / 配乐要求]
示例:
0-x 秒:特写女主撕契约镜头,纸屑飘落,总裁单膝跪地伸手阻拦,眼神慌乱,女主侧身躲开,嘴角挂着冷漠笑意
总裁(卑微慌乱):"苏晚,别走!"
"x-y 秒:女主抬脚避开他的手,将撕碎的契约纸扔在他脸上,镜头扫过周围宾客的窃窃私语
女主(冷漠反杀):"顾总,现在求我?晚了!"
y-z 秒:总裁僵在原地,脸上沾着纸屑,女主转身昂首离开,红裙裙摆飘动
音效:华丽又带张力的背景音,契约撕碎的声响,宾客轻微的窃窃私语声
风格:电影感写实
5. 声音与口型精准控制
支持原生音画同步,支持精准控制人声对白、音色、情绪、环境音效。
提示词模式:
[画面描述] + [短句台词(用引号标注,按时长控制字数,标注角色和情绪)] + [音效 / 配乐要求]
示例:
固定镜头,男主坐在窗边的沙发上,侧逆光勾勒轮廓,窗外是飘雪的冬夜,男主眼神温柔,对着镜头缓缓说话,音色低沉有磁性,语气温柔治愈
男主:"雪落的时候,总有人在等你回家。这个冬天,愿你有温暖的灯火,也有满心的欢喜。"
背景音:轻柔的钢琴声,窗外雪花飘落的沙沙声,整体氛围安静治愈,电影感暖色调
高级提示词技巧
时间戳分镜法
对于8-12秒长视频,使用时间戳精确控制每个镜头的内容,这是实际创作中最常用的高级技巧:
0-x 秒:[画面描述 + 镜头语言]
x-y 秒:[画面描述 + 镜头语言]
y-z 秒:[画面描述 + 镜头语言]
示例——仙侠战斗:
仙侠高燃战斗镜头,金红暖色调。
0-x 秒:低角度特写主角蓝袍衣摆被热浪吹得猎猎飘动,双手紧握雷纹巨剑,剑刃赤红电光持续爆闪,地面熔岩翻涌冒泡,远处魔兵嘶吼着冲锋逼近,主角低喝 "今日,便以这柄剑,镇尔等邪祟!",伴随剑鸣与熔岩咕嘟声;
x-y 秒:环绕摇镜快切,主角旋身挥剑,剑刃撕裂空气迸射红色冲击波,前排魔兵被击飞碎裂成灰烬粒子消散,伴随剑气破空声与魔兵惨嚎;
y-z 秒:仰拍拉远定格慢放,主角跃起腾空,剑刃凝聚巨型雷光电弧劈向魔兵群,音效收束为余音震颤与渐弱风声。
镜头语言词汇库
| 类别 | 关键词 |
|---|
| 景别 | 大远景、远景、全景、中景、近景、特写、大特写 |
| 运镜 | 推镜头、拉镜头、摇镜头、移镜头、跟拍、环绕拍摄、航拍、手持跟拍、希区柯克变焦 |
| 角度 | 平视、俯拍、仰拍、低角度、鸟瞰视角、鱼眼镜头、第一人称视角、主观视角 |
| 节奏 | 慢动作、快切、延时摄影、升格拍摄、硬切、卡点 |
| 焦点 | 浅景深、深景深、焦点转移、虚化背景、选择性对焦 |
| 特殊 | 遮挡擦镜转场、无缝渐变转场、环绕摇镜快切特写、定格慢放 |
风格词汇库
| 类别 | 关键词 |
|---|
| 画面质感 | 电影感、胶片质感、高清晰度、8K分辨率、HDR、RAW质感、4K医学CGI |
| 影像风格 | 好莱坞大片、独立电影、纪录片、MV风格、广告大片、Vlog风格 |
| 色调氛围 | 暖色调、冷色调、高对比度、低饱和度、莫兰迪色系、赛博朋克霓虹、红金高饱和 |
| 艺术风格 | 写实主义、超现实主义、极简主义、蒸汽波、赛博朋克、中国风水墨、3D国漫CG |
| 光影效果 | 自然光、侧逆光、丁达尔效应、霓虹灯光、月光、黄金时段光线、体积光 |
| 动画风格 | 中国奇幻动画电影风格、超精细CG动画、日漫赛璐璐、3D渲染写实 |
场景类型与提示词策略
电商/广告
- 产品360度旋转展示、爆炸分解、3D渲染特效
- 第一人称沉浸式手作体验
- 配合广告词和品牌logo
示例:
基于首帧图中的可口可乐饮料,360度高速旋转2圈后,突然停住蓄力分裂成了3个部分进行展示。随后分解后的可口可乐饮料罐的上中下三部分快速向内旋转合成,一罐完整的可口可乐饮料,3D渲染产品展示特效,动感产品特效展示
AI漫剧/仙侠
- 使用首尾帧控制变身/变装效果
- 时间戳分镜法控制每段画面
- 详细的特效描述(法阵、能量波、粒子效果)
- 台词用引号标注,指定语气
短剧/对白
- 画面+台词分开描述,台词标注角色和情绪
- 音效单独描述
- 可指定旁白说"预知后事如何,请看下集"
科普教学
- 4K医学CGI风格
- 半透明人体结构可视化
- 科学过渡自然流畅
- 配合教育性旁白
MV/音乐卡点
- 分镜头描述每个镜头的场景、动作、音效
- 强调声音设计与节拍同步
时长策略
单段视频(4-12秒)
Seedance 1.5 Pro 单次生成上限为12秒,下限为4秒,所有生成内容必须严格遵守此限制。
- 5-8秒:适合完整的短场景、单个动作、简短特效展示。可选用时间戳分镜,分为 2 个阶段。
- 9-12秒:适合完整叙事、短剧对白、剧情片段。强烈推荐时间戳分镜法,分为 3 个阶段精确控制。
注意事项
- 使用自然流畅的中文描述,所有提示词必须使用中文编写
- 描述要具体且有画面感,避免抽象模糊的表述
- 镜头语言和动作描述要有时间顺序,让模型理解画面的先后关系
- 对于10-12秒长视频,推荐使用时间戳分镜法精确控制
- 台词/对白用引号包裹,并标注角色和情绪,所有对白必须符合自然语速,避免几秒镜头内出现过长台词,中文剧情对白按 3–5字/秒 估算;激烈情绪台词最高按 6字/秒 控制
- 音效描述单独成行,与画面描述分开
- 合理控制提示词长度,重点突出,避免信息过载
- 情绪和氛围的描述对最终效果影响很大,不要忽略
- 严格遵守4-12秒的时长上限,不要生成超过12秒的单段提示词
交互指引
当识别到用户有视频提示词生成需求时,按以下流程进行:
第一步:获取用户输入
主动收集用户对视频的核心需求,包括但不限于:视频内容描述、情绪氛围、镜头风格、用途场景、是否需要人声对白等。
第二步:确认关键参数
针对未明确的参数,通过提问逐一确认:
- 视频时长:4-12秒,默认10s 时长最低4s,如果小于4s则自动调整为4s
- 首尾帧配置:纯文本(无图片输入)/ 首帧图(用户上传1张图片,用于控制视频开头)/ 首尾帧图(用户上传2张图片,用于首尾帧控制)
- 视频分辨率:仅支持720p
- 视频比例:横屏16:9 / 4:3 / 21:9 / 竖屏9:16 / 3:4 / 1:1 /自动推荐
- 是否需要声音:是 / 否
- 补充偏好(可选):情绪氛围、镜头风格、用途场景、是否需要人声对白等
第三步:生成提示词
根据用户需求及确认的参数,生成视频提示词,并按照以下固定结构输出json文件,不需要输出json和:
{
"prompt": "xxx", // 提示词内部如需使用引号,统一使用英文单引号 ',禁止使用英文双引号 "
"duration": 10, // 视频时长(秒,整数),最长12秒
"ratio": "9:16", // 视频比例:9:16 / 16:9 / 4:3 / 3:4 / 1:1 / 21:9
"resolution": "720p", // 分辨率:720p
"has_audio": false // 是否包含声音
}
第四步:配置信息用户确认(⛔ 必须执行,不可跳过)
将第三步生成的完整视频配置,整理为易读格式发送给用户,确认参数无误后再执行下一步:
以下是根据您的需求生成的视频制作参数,请确认:
1. 视频内容: {{prompt}}
2. 视频时长: {{duration}} 秒
3. 画面比例: {{ratio}}
4. 分辨率: {{resolution}}
5. 是否带声音: {{has_audio}}
6. AI点数消耗约: {{ai_points}} 点
该工具会产生除模型推理外的AI点数消耗,确认无误请回复「确认」,我将立即为您生成视频。
AI点数计算规则:
- 无声视频:4 AI点/秒
- 有声视频:8 AI点/秒
- 本次消耗:{{duration}} 秒 × {{rate}} 点/秒 = {{ai_points}} 点
⚠️ 重要:必须等待用户回复「确认」后,方可进入下一步操作。
第五步:调用脚本生成视频
⛔ 执行前提检查(必须满足以下所有条件):
- ✅ 已完成第四步的参数展示
- ✅ 用户已回复「确认」二字
- ✅ 未收到用户的修改请求或取消请求
如果以上任一条件不满足,禁止执行本步骤。
用户确认配置无误后,调用generate_video.py脚本,传入第三步生成的json文件,执行视频生成操作。
第六步:发送生成结果
视频生成完成后,及时将视频文件发送给用户,确认用户接收无误,流程结束。
常见用法
- 纯文生视频(无图片输入)
python3 generate_video.py --script script.json
- 首帧图生视频(指定首帧)
python3 generate_video.py --script script.json --first-frame first.png
- 首尾帧图生视频(指定首尾帧)
python3 generate_video.py --script script.json --first-frame first.png --last-frame last.png
- 根据任务ID查询下载视频(异常处理:任务已创建但未正常获取视频时,使用任务ID手动查询并下载)
python3 query_video_task.py --task-id your_task_id
路径说明
--script 可以是相对路径或绝对路径
--first-frame 可以传单张首帧图片路径,支持相对路径
--last-frame 可以传单张尾帧图片路径,支持相对路径
--output 默认存放~/.openclaw/workspace/generated-videos/位置