| name | script-to-shot-table |
| description | 将剧本、故事梗概、口播稿、小说段落、广告脚本、短视频文案或零散剧情描述转化为面向 AI 图片、视频和漫画生成的 Markdown 镜头组文档。强调先按叙事任务整理镜头组,再在组内保留少量必要镜头节拍;单一分镜表只作为辅助,不作为默认核心产物。 |
| version | 1.2.0 |
| author | Hermes Agent |
| license | MIT |
| metadata | {"hermes":{"tags":["shot-groups","directing","screenwriting","markdown","ai-video","image-generation","comics"],"related_skills":["creative-production-pipeline","video-prompt-director","image-generation-plan","manga-creation-pipeline"]}} |
剧本转镜头组
适用场景
当用户提供剧本、故事梗概、小说段落、口播稿、广告文案、分场大纲、短视频脚本或聊天式剧情说明,并希望用于 AI 图片生成、AI 视频生成、漫画页生成、关键帧计划或导演制作沟通时,使用本技能。
默认产物不是逐条单镜头分镜表,而是 镜头组文档。镜头组是后续生成的基本单位:
- 对视频:一个镜头组通常对应一个可生成/可剪辑的视频段落,包含 1-6 个连续动作节拍。
- 对图片:一个镜头组通常导出 1 张关键帧、概念剧照、角色状态图、环境图或道具图。
- 对漫画:一个镜头组通常对应一张单幅大图或一页多格漫画。
单镜头只在镜头组内部用于说明动作节拍、信息点和剪辑顺序;不要把“逐个镜头生成”作为默认目标。
核心目标
- 先理解剧情、人物关系、场景变化、情绪节奏和生成用途,再拆成镜头组。
- 每个镜头组承担一个明确叙事任务,而不是只追求镜号细碎完整。
- 镜头组要方便后续转成图片生成计划、视频提示词、漫画页、关键帧或剪辑段落。
- 组内镜头节拍要短、清楚、可视、可听,但不要求为每个节拍单独生成。
- 输出必须保留剧情顺序、连续性和人物数量;参考资产、生成风险提示等只在用户明确要求完整导演说明书或资产计划时加入。
输入处理原则
- 如果原文已有场次、镜号、对白编号或页码,保留其顺序,但重新组织为镜头组。
- 如果原文没有结构,按地点、时间、动作目标、情绪转折、信息释放和生成单位主动拆组。
- 不虚构关键剧情,不改变人物关系、事件顺序和核心设定。
- 可以补充必要镜头节拍、景别、动作、声音、转场和生成注意事项,但补充必须服务原文意图。
- 缺失信息不影响拆组时,保守补全;缺失信息会改变剧情事实时,标注待确认或询问用户。
- 不把抽象心理直接写成画面;要转成观众能看见或听见的动作、表情、道具、空间和声音。
- 不把长故事直接丢给图片或视频模型;先做镜头组,再由镜头组派生提示词。
极简镜头组规则
当用户要求精简、重构或批量改写镜头组时,默认采用极简格式,而不是导演说明书格式。每个镜头组只保留:
编号:如 EP36-SG01。
时长建议:只写 4-15s 范围内的建议时长,如 6-8s、8-12s、10-15s;不要写 00:00-00:25 这种绝对时间段。
场景:地点和必要空间状态。
人物:本组出现的人物;无人物写无。
内容:用最简洁的语言写发生了什么,什么人说了什么话。
不要保留导演总判断、节奏结构、叙事任务、参考资产、画面内容、组内节拍、声音/台词、生成用途、导演校验、压缩方案、后续派生提醒、制作备注等 boilerplate。不要把每集硬套成“开场钩子 / 人物进入 / 核心冲突 / 精神落点 / 结尾钩子”;只有源剧本自然如此时才沿用。
推荐文档结构
# 《标题》镜头组
## EP01-SG01:<短标题>
- 编号:EP01-SG01
- 时长建议:6-8s
- 场景:<地点和必要空间状态>
- 人物:<本组出现的人物;无人物写无>
- 内容:<最简洁地写发生了什么,什么人说了什么话。>
默认只保留:编号、时长建议、场景、人物、内容。除非用户明确要求导演说明书、资产计划或生成提示词,不要追加其他字段。
镜头组拆分标准
优先按“叙事任务”拆组,而不是按摄影机每次变化拆镜头。
适合拆成新镜头组的情况:
- 地点或时间明显变化。
- 角色目标改变。
- 情绪进入新阶段。
- 观众需要获得一个新的关键信息。
- 动作进入新的因果段落。
- 后续生成需要一张新的关键帧、一个新视频片段或一页新漫画。
- 参考资产、人物状态、场景空间或视觉基调发生变化。
不需要拆成新镜头组的情况:
- 只是同一动作的不同景别。
- 只是一个人物说话和另一个人物反应。
- 只是同一空间内的连续小动作。
- 只是模型可以在同一段视频或同一页漫画里完成的连续节拍。
组内节拍规则
组内节拍用于指导生成和剪辑,但不要变成过细的单镜头表。
- 视频镜头组:通常 1-6 个节拍;复杂动作优先压缩成 3-5 个关键节拍。
- 图片关键帧:只需写清关键瞬间,组内节拍用于解释前因后果。
- 漫画页:组内节拍可直接变成 3-5 格;手机阅读最多 6 格。
- 动作戏:拆短、拆清楚,避免一个节拍里塞多个敌人、多个动作和多句台词。
- 对话戏:按情绪变化和信息释放组织,不必每句对白一格/一镜。
- 氛围戏:可以少节拍,但必须写清空间、主体、动作和情绪推进。
生成用途标注
每个镜头组都要标注它最适合的后续用途:
视频段落:适合转成一个视频 prompt 或一个可剪辑片段。
图片关键帧:适合生成一张概念剧照或关键帧。
漫画页:适合转成一页多格漫画或一张单幅漫画图。
环境图:重点是空间、地点、动线和气氛。
角色状态图:重点是人物身份、服装、状态和情绪。
道具图:重点是物件结构、功能和后续回收。
同一镜头组可以有多个用途,但要写出主用途,避免后续生成目标混乱。
压缩为生成段落
长剧本或动作量大的故事,镜头组完成后应追加一节“压缩方案”:
## 3. 压缩为视频 / 漫画 / 图片生成段落的方案
1. <段落名>:镜头组 01-02。
2. <段落名>:镜头组 03-05。
3. <段落名>:镜头组 06。
作用:
- 视频生成时,决定哪些镜头组可以合并成一个片段。
- 图片生成时,决定哪些镜头组只需要一张关键帧,哪些需要拆成多张。
- 漫画生成时,决定哪些镜头组变成单幅大图,哪些变成多格页。
- 剪辑时,明确段落功能和节奏,不被单镜头粒度拖散。
可视化写法
避免:
- “表现紧张”
- “气氛很好”
- “人物很震惊”
- “命运感很强”
- “主角内心复杂”
改成:
- “角色攥紧手机,屏幕冷光映在发白的脸上。”
- “门缝里透出一条暖光,走廊其余部分完全黑暗。”
- “她读完纸条后抬头,嘴唇微张,手指停在纸角。”
- “远处信号灯一盏接一盏亮起,像道路延伸到黑暗里。”
常见反模式
-
逐镜头过度拆碎
- 问题:每个推拉摇移都变成一行,后续 AI 生成无法稳定执行。
- 修正:先合并为镜头组,只保留关键节拍。
-
一组塞完整场戏
- 问题:地点、目标、情绪都变了,模型无法理解主任务。
- 修正:按叙事任务拆成多个镜头组。
-
只写漂亮画面,不写任务
- 问题:关键帧好看但不推进故事。
- 修正:每组必须写
叙事任务。
-
只写剧情摘要,不写生成约束
- 问题:后续图像/视频会加人、换脸、换场景或重复角色。
- 修正:每组加入
导演校验,写明人数、身份、场景和禁错点。
-
把图片计划反向改剧情
- 问题:为了生成好看,新增不属于原文的桥段。
- 修正:镜头组只服务源文档;图片/视频计划只能从镜头组派生。
技能自升级规则
- 每次发生大重写、大重构或用户明确纠正镜头组规范时,必须把新规则沉淀回本技能;不要只改当前项目文件。
- 如果项目内有
.art-skills/script-to-shot-table/,同步更新项目技能副本。
- 升级时删除或替换冲突的旧模板,避免下次继续输出 boilerplate。
输出前检查