| name | archival-fragments-lite |
| description | 「档案剪贴」视觉风格 + 关键帧串联首尾帧方法。满幅象牙纸、单色印刷黑白、单一暗砖红;先出一串各不相同的参考图,再用相邻两张作为首尾帧生成镜头,接点严丝合缝。不绑定任何具体模型,任何支持首尾帧的视频工具都能用。当用户要做档案剪贴/纸质拼贴/编辑设计风格的短片,或想用首尾帧方式做连贯分镜时使用。 |
Archival Fragments(简版)
这个 skill 只固定两件事:这套视觉风格,和参考图 → 首尾帧的做法。
不绑定模型、不装依赖、不代跑流程。你用什么图片模型、什么视频工具都行,只要那个视频工具支持首尾帧。
三条硬约束
违反任何一条,出来的片子必废。这三条都是真实翻过车才写下来的。
1. 每一镜的参考图必须不同
N 个镜头需要 N+1 张各不相同的参考图。
"相邻两镜共用同一张图"的意思是:第 1 镜的尾帧 = 第 2 镜的首帧,这一张图被这两镜共用。
不是整片共用一张图。
绝对禁止:
- 拿同一张图当所有镜头的输入
- 拿一张结构图、示意图、信息图当所有镜头的参考
- 把
assets/style-reference.png 当成生成输入——它是给人看的风格参考板
真实发生过:Agent 拿一张结构图当所有镜头的参考,结果几十个镜头画面一模一样,整条片子等于一张静态图配了段旁白。
自检:参考图张数 == 镜头数 + 1;任意两张的画面描述不重复;每张有自己独立的提示词。
2. 具象优先,不要抽象图形
纸和红线是画面的地面,不是主体。站在上面的必须是观众不用想就懂的具体东西。
给每句话找一个通用符号,全片收敛到 2–3 个,各用几次:
| 语义 | 符号 |
|---|
| 谁在哪、份额、从无到有 | 世界地图 + 图钉 + 标签 |
| 价格、代价、失衡 | 天平(一端实物,一端不断加码) |
| 排名、递进、还差多远 | 台阶 / 领奖台 |
| 数量、密集、庞大 | 一大堆实物(芯片、纸片、人群) |
| 时间点、正式性 | 翻牌板、印章、公文 |
| 被否定、被抹掉 | 一只手把东西撕走 / 白纸盖上 |
用空白纸加一条线表达"这个位置是空的"、用三个方块表达"三家公司"——这类抽象图形观众看不懂,实测失败。
3. 慢不等于静
每一镜结尾画面必须和开头明显不同。留白镜也要有一个横跨画面的动作在推进。
首尾帧天然帮你守住这条:首帧 ≠ 尾帧,画面必然在变。
三步做法
第一步:拆镜,列出参考图链
把文案按句拆成镜头(每句 2–3 镜),设计一条连续的视觉旅程:
A01 ──W01──> A02 ──W02──> A03 ──W03──> A04 ...
这一镜的结束状态,就是下一镜的开始状态。
画面推进只有四种合法方式,每镜必属其一:
| 方式 | 例子 |
|---|
| 物件变化 | 地图上零根图钉 → 一根 → 三根 |
| 景别变化 | 世界地图全景 → 推近韩国 → 特写一个钉孔 |
| 状态变化 | 天平上几枚硬币 → 硬币堆成高塔 |
| 主体更替 | 地图退场 → 天平升起 |
拆完先给用户过目——改一张表 5 分钟,重新生成要几小时。
第二步:出参考图
文生图,一张一个提示词,不挂任何参考图。每张提示词 = 固定风格前缀 + 该张画面。
写法见 keyframes.md,风格前缀在那份文档里。
出完逐张审:文字有没有崩、语义观众看不看得懂、能不能和前后接上。图便宜、视频贵,这一步省不得。
第三步:用首尾帧生成镜头
每镜挂两张图:第 N 张作首帧、第 N+1 张作尾帧。提示词只写运动,一句话。
写法见 shots.md。
对工具的要求
| 环节 | 要求 |
|---|
| 图片 | 能出你要的比例(推荐 4:3),文字渲染较准 |
| 视频 | 必须支持首尾帧——也叫「首尾帧」「first & last frame」「start/end frame」「frames to video」 |
不支持首尾帧的纯文生视频工具做不了这套方法,镜与镜之间必然跳变。
生成时长:多数工具最短 5 秒,而这个风格每镜通常只用 1–3 秒。统一生成 5 秒,剪辑时变速压到目标时长——节奏在剪辑台上定,不在提示词里定。
文档
examples/ 是一条已完成 67.3 秒成片的配置:35 张参考图提示词原文、34 条运动句。
照着改结构,不要照抄内容——那些符号是为特定题材设计的,换题材要重新找。
assets/example-01..08-*.jpg 是八张连续参考图,看它们怎么一张张推进,就明白"每镜画面必须不同"是什么意思。