| name | AI-video-prompt |
| description | 把脚本、故事节拍或镜头想法转成图片参考型 AI 视频提示词,包含图片参考绑定、秒级动作、声音设计和硬约束。使用场景:用户需要 AI 视频提示词、Seedance 提示词、图片参考视频生成、脚本转视频提示词、多图参考、首尾帧、全能参考、视频提示词,或希望把脚本转成可直接复制使用的完整视频提示词。 |
AI 视频提示词
生成图片参考型视频工作流的完整提示词:先定义图片参考,再写高密度单段提示词,包含秒级动作、声音设计和明确约束。
快速开始
当用户提供脚本、故事、口播稿或粗略想法时:
- 按场景、地点、时间跳跃、动作节拍或情绪转折,把内容拆成 8-15 秒的生成单元。
- 为每个单元选择参考模式:多张图片锚定时用
多图参考,需要首尾连续时用 首尾帧,角色/场景/道具混合锚定时用 全能参考,只有动作由参考视频驱动时才用 动作模仿。
- 为每个单元输出一组完整提示词:
片段一:[一句话节拍]
生成模式:[多图参考 / 首尾帧 / 全能参考]
模型参数:Seedance 2.0 | 720p | 16:9 | [10s/12s/15s]
参考图片:
图片1:[用途,例如人物造型 / 场景视觉基因 / 道具]
图片2:[用途]
提示词:
[可直接复制使用的图片参考型完整视频提示词]
如果用户没有提供参考图,也要生成 图片1、图片2 等占位说明,并在提示词前明确每张图应该是什么。
提示词结构
写成一段高密度提示词,不写松散分镜表。只有当 【】 标签能增强控制力时才使用。
内容顺序如下:
- 开场控制句:时长、镜头形式、核心风格、摄影/胶片质感、画幅比例。
- 图片绑定:动作开始前先定义每张图片的用途。
- 场景 / 空间结构:地理位置、主体位置、纵深层次、人群/车流/道具。
- 秒级动作:10-15 秒片段用
【0-2秒】、【2-4秒】 等时间段;揭示、遮挡、硬切、变装等关键事件要写准确秒点。
- 运镜:距离、高度、镜头行为、跟拍方向、手持/稳定器、什么时候机位不能动。
- 声音设计:先写环境声底,再按时间写事件音;说明收音距离和清晰度。
- 风格 / 光影 / 色彩:具体胶片、摄影机、镜头、色彩方案、光线方向、颗粒、对比度。
- 硬约束:用
必须严格遵守 标记关键规则,尤其是比例、空间逻辑、连续性、表演尺度和禁止失败项。
图片参考规则
- 使用清晰的图片引用:
图片1、图片2、图片3;需要强绑定时使用 @图片1。
- 每张图只承担一个明确任务:人物身份、服装造型、首帧、尾帧、场景视觉基因、道具、生物/机甲/物体或风格参考。
- 绑定人物时写清锁定项:脸、发型、服装、身体比例、物体轮廓、颜色、材质、和场景的关系。
- 绑定场景时把图片当作视觉基因:光线、构图、墙面/道路布局、色温、氛围。
- 不要只写“参考图片”。必须说明锁定什么、允许变化什么。
- 多图提示词要在动作发生处再次点名图片作用,例如“参考图片1的造型”“首帧锁定图片2”“票图片3从画面顶部飘入”。
约束规则
约束是生产控制,不是装饰词:
- 比例:全身 / 半身 / 特写,主体在画面中占多大。
- 空间逻辑:人物、道路、车辆、道具、背景层次分别在哪里。
- 动作逻辑:动作顺序、速度变化、遮挡时机、硬切时机、未完成动作。
- 表演尺度:真实、克制;除非用户要求,否则不要戏剧化。
- 声音:用户没要求配乐时默认无配乐;要说明远距离街拍、对白模糊或事件音清晰。
- 连续性:人物、服装、道具状态、首尾帧和下一镜头衔接。
- 负面控制:避免空街、摆拍群演、游戏 CG 感、镜头过近、肢体错误、物体运动不可能、需要模糊的对白变得清晰。
输出风格
- 每条提示词都必须可直接复制使用。
- 提示词内部优先使用一段强控制文本和
【】 分区,不要写成一堆 Markdown 项目符号。
- 动作要有物理精度:重心、手的位置、视线、呼吸、衣料摩擦、物体路径。
- 声音要像画面一样具体。
- 每个片段结尾保留模型参数和图片上传说明。
脚本转完整提示词示例见 verification-sample.md。