| name | mx-shell-prompt |
| description | Turn a full script, story, or voiceover draft into structured, cinematic video-generation prompts — automatically segmented scene-by-scene. Best for structured-prompt video tools like Seedance 2.0, Kling, and Jimeng (即梦). Use this skill whenever a user pastes a script / story / 口播稿 / 分镜脚本 and wants it turned into video prompts, asks to write a video prompt, generate a storyboard, split a script into shots, or describe a cinematic scene for video AI. Each segment gets a complete prompt: 基础设定 (characters), 道具 (props), 场景 (scene), 声音 (sound), 氛围与画质 (mood & quality), 画面内容 (shots — auto-decomposed into a shot list or a long take, each with 景别/构图/运镜). Also trigger on keywords: video prompt, video generation, AI video, text-to-video, storyboard, 分镜, 拆分镜, 视频提示词, 视频生成, 脚本转视频, Seedance, Kling, 即梦, cinematic prompt, shot list, camera movement. Trigger even if the user only has a rough one-sentence idea — treat it as a single segment and flesh it out. |
MX Shell Prompt — 脚本转结构化视频提示词
把一段脚本(故事、口播稿、场景描述,甚至一句粗略想法)自动拆成板块,每个板块产出一条完整、可直接复制的电影级视频提示词。
主战场是结构化分镜类工具:Seedance 2.0 / Kling / 即梦。这类工具吃的就是「分板块 + 分镜 + {{Portrait N}} 图片绑定」的中文结构化 prompt。(Sora / Runway / Pika 更吃英文流畅散文 prompt,本格式不是为它们设计的——如需输出给这类工具,把结构化内容改写成英文电影化段落并去掉 {{Portrait}} 引用。)
核心理念:
- 一个板块 = 一次生成单元。视频工具单次生成时长有限,所以脚本要先按场景/节拍切成板块,每个板块独立成片。
- 每个板块由三根支柱构成 —— 谁在哪(基础设定+道具+场景+声音)、什么感觉(氛围与画质)、发生什么(画面内容)。
工作流程
Step 1: 解析脚本,自动分段(板块化)
输入通常是一整段脚本/故事/口播稿。先把它切成板块。切分边界:
- 场景/地点变化(书房 → 街道)
- 明显时间跳跃(白天 → 深夜)
- 故事节拍或情绪大转折(平静 → 冲突爆发)
- 主体/视角切换(从 A 的视角转到 B)
不要过度切分:同一地点的连续动作就是一个板块,哪怕它很长(板块内部可以走长镜头或多分镜)。也不要切得太粗:一个板块塞下两个不相干的场景,会超出单次生成能力。
先给分段概览再展开——列出板块清单让用户确认,避免在错误的分段上浪费整篇输出:
我把脚本拆成 N 个板块:
板块一:[一句话场景摘要]
板块二:[一句话场景摘要]
...
确认这个分段吗?要合并/拆开某块直接说。(说「直接写」我就按这个展开)
如果输入只是一句话或粗略想法 → 视为单板块,跳过确认直接补全。
如果信息不足以写出高质量提示词,问 2-3 个关键问题:目标工具?视觉风格偏好?整体画幅(16:9 横屏 / 9:16 竖屏 / 2.39:1 宽荧幕)?
Step 2: 为每个板块构建完整结构
阅读 references/template.md 了解结构骨架。每个板块包含 6 个部分:
基础设定(角色):每个角色 —— 外貌体型、服装、标志性特征、气质/性格。有参考图用 {{Portrait N}} 标记关联。
道具:影响画面或剧情的关键物件 —— 不只是列出来,要写清状态和与角色/事件的关系(不是「一把枪」,而是「插在枪套里的左轮,枪身有磨损划痕」)。道具是连贯性最容易丢的地方,单列一栏强制交代。
场景:环境类型、时间、天气、空间布局、氛围细节。具体到能「闻到」—— 不是「一个房间」,而是「午后阳光透过百叶窗洒进来的书房,灰尘在光柱中漂浮」。
声音:默认「不需要配乐,仅保留同期声」。用户明确要求音乐或氛围音时再调整。
氛围与画质(阅读 references/cinematic-vocabulary.md 选词):
- 风格核心:1-2 个艺术风格关键词 + 质量约束(电影级质感、超写实、真人实景拍摄、杜绝游戏CG感)。负面指令集中放这里,不要散落到每个镜头。
- 视觉基调:具体摄影机 + 镜头 + 附加效果(如「IMAX胶片摄影机 + Panavision C系列镜头(动态模糊)」),不要只写「电影质感」。
- 色彩与影调:具体色彩方案(不是「温暖」而是「复古暖橙+海盐蓝高对比」)、胶片质感、光线来源方向、明暗关系、画幅比例。
- 风格参考(可选):导演/影视参考(如「参考《辐射》美学 + 皮克斯动作控制」)。
Step 3: 画面内容 —— 自动判断分镜 or 长镜头
阅读 references/shot-catalog.md 选景别、构图、运镜。根据板块内容自动选形式:
- 长镜头(一镜到底):单一连续动作、沉浸式氛围渲染、一个完整情绪流、空间巡游。用运镜带动景别变化,分阶段写(起 → 承 → 转)。
- 多分镜:动作多、主体多、情绪有转折、信息需要切换。拆 3-5 个镜头。
无论哪种,每个镜头(或长镜头的每个阶段)都写四要素:
- 景别:具体说明拍哪里(如「中景,机器人腿部以上」)
- 构图:主体位置、前景/中景/背景层次、视觉重心
- 运镜手法:固定、跟踪、推进、手持等
- 画面内容:具体动作、表情变化、事件的物理描述
时长 → 镜头数(粗略,单镜头约 2-5s):5s ≈ 1 个长镜头或 1-2 分镜;10s ≈ 2-3 分镜;15s ≈ 3-4 分镜;30s ≈ 5-7 分镜。
多分镜设计原则:相邻镜头景别要有变化;运镜节奏跟随情绪(紧张推进、平静固定);留一个「呼吸镜头」(全/远景)让观众喘息;首尾镜头呼应或对比。
Step 4: 跨板块一致性
角色、风格核心、画幅在第一个板块定义清楚,后续板块直接复用,只写变化(换了衣服、换了地点、道具状态变了)。这样多板块串起来才是同一部片子,而不是几条无关片段。
Step 5: 呈现与迭代
输出全部板块的完整 copy-paste-ready 提示词。然后问:「需要调整分段、改某个板块的风格、增减镜头、或把某块从分镜改成长镜头吗?」
写作原则
视觉要超具体:不是「漂亮的日落」,而是「金色夕阳穿过百叶窗投下长影,皮肤上温暖的琥珀色调,画面边缘柔和的镜头光晕」。
动作要有物理精度:不是「角色很害怕」,而是「双手缓缓抬至下巴前方呈防御姿态,身体微微发抖,重心下沉」。
必须有摄影语言:每个镜头都含景别 + 构图 + 运镜。这三者定义了电影感的 80%。
道具要交代状态:道具单列,写清它的样子、状态、和角色的关系——这是画面连贯性最容易丢的地方。
角色描述保持一致:基础设定中写过的特征,分镜里不重复,只写动作和表情变化。跨板块同理。
节奏设计:紧张场景短镜头快切,抒情场景长镜头慢推。镜头时长要有变化。
负面指令集中在风格核心:「禁止游戏CG感」「禁止动作僵硬」放风格核心,不散落到每个镜头。
输出格式
板块一:[场景摘要]
【基础设定】
角色1:{{Portrait N}} [外貌、服装、特征、气质]
角色2:{{Portrait N}} [外貌、服装、特征、气质]
【道具】
[关键道具:样子、状态、与角色/事件的关系]
【场景】
[环境、时间、天气、空间、氛围]
【声音】
不需要配乐,仅保留同期声。
【氛围与画质】
风格核心:[风格关键词]、电影级质感、超写实、真人实景拍摄、杜绝游戏CG感。
视觉基调:[摄影机] + [镜头]([附加效果])拍摄。
色彩与影调:[色彩方案],[胶片质感],[光线描述],[明暗关系],[画幅比例]。
风格参考:[导演/影视参考]。(可选)
【画面内容】
分镜一:
景别:[景别,具体说明拍哪里]
构图:[构图描述]
运镜手法:[运镜]
画面内容:[具体内容]
分镜二:
...
[—— 或长镜头形式 ——]
长镜头(一镜到底):
起:景别/构图/运镜 + 画面内容
承:景别/构图/运镜 + 画面内容
转:景别/构图/运镜 + 画面内容
——————————
板块二:[场景摘要]
(角色/风格已在板块一定义,此处只写变化)
【基础设定】[沿用板块一,仅说明变化]
...
常见错误
- 分段失当:一个板块塞两个不相干场景,或把连续动作切碎 → 按场景/时间/情绪节拍切,连续动作不切
- 漏道具:枪、酒瓶、关键物件没单独交代 → 道具单列,写状态
- 跨板块不一致:每个板块重新描述角色/风格,导致不像同一部片 → 板块一定义,后续只写变化
- 太模糊:「电影质感」不指定摄影机镜头 → 写具体设备
- 忘声音/忘画幅:每个板块都要有声音行;画幅在板块一指定
- 角色描述重复:分镜里重复基础设定已有描述 → 只写新动作
- 运镜与情绪不匹配:温柔场景用甩镜 → 运镜服务情绪
- 风格堆砌:同时引用 5 个风格 → 选 1-2 个强风格
- 负面指令散落:每个镜头都写「不要CG感」 → 集中在风格核心
情绪 → 电影术语速查
| 情绪/场景 | 推荐术语 |
|---|
| 害怕/恐惧 | 浅景深、手持晃动、快速推进、冷色调 |
| 惊讶/揭示 | 缓慢前推、移焦(从前景到主体)、停顿 |
| 动作/追逐 | 甩镜、速度变化、低角度跟踪、高对比 |
| 浪漫/温柔 | 柔焦、暖色调、缓慢推轨、特写 |
| 紧张/悬疑 | 固定全景、沉默、缓慢变焦、暗调 |
| 孤独/沉思 | 远景留白、固定机位、自然光、低饱和 |
| 欢乐/活力 | 手持跟拍、高饱和、明亮光线、中景 |
| 史诗/壮丽 | 摇臂升降、远景、IMAX画幅、金色光线 |