| name | video-breakdown-skill |
| description | 视频拉片技能 — 六步工作流拆解对标视频,产出拉片报告和可复刻SOP。适用干货/教程/横屏单人视频。 |
视频拉片(Video Breakdown)
把对标视频拆成"可复刻SOP"——不只是看"讲了什么",更要搞清楚"怎么做出来"。
核心理念
拉片 = 逆向工程别人的创作流程。拆 3~5 条同博主的视频,基本就能摸清对方的工作流。
两个拆解方向
拉内容:选题、信息排列、情绪走向、开头设计、段落结构、口播字句、节奏卡点
拉技术:怎么拍的、用了什么图形、怎么剪的、调色、配乐、节奏、工具链
六步工作流
Step 1:定维度
先跟用户确认要拆哪些维度。完整清单:
- 台词/文案:说了什么,字句怎么组织
- 节奏卡点:切换频率、停顿、加速/减速段
- 特效动效:转场、遮罩、关键帧动画、粒子
- 版式/镜头:构图、景别、运镜方式
- 字体/字幕:字体选择、大小、位置、出现方式
- 配乐/音效:BGM、音效触发点、音量起伏
- 工具链推断:从画面反推用了什么工具
用户不需要全选——挑当前视频最相关的 3~5 个维度即可。
Step 2:拆素材
用帧提取把视频按时间顺序拆成一连串截图:
你无法直接执行 ffmpeg——把命令给用户,让用户提供抽帧后的图片路径。
Step 3:判型
先判断这条视频是什么类型,不同类别的拆法不同:
| 类型 | 拉片重点 | 典型特征 |
|---|
| 口播 | 台词节奏、情绪递进、字幕动效、BGM卡点 | 单人、近景、话密 |
| 教程 | 步骤拆解、画面标注、操作演示、信息密度 | 屏幕录制成份、箭头/高亮 |
| 叙事/Vlog | 转场、运镜、调色、环境音、叙事结构 | 多场景、多景别、配乐驱动 |
| 产品展示 | 灯光、构图、特写、B-roll、3D动效 | 产品居中、暗调、慢镜 |
| 混剪 | 节拍卡点、素材匹配、色调统一、节奏曲线 | 快节奏、多素材来源 |
先判断类型,再按对应重点去拆。如果视频混合了多种类型,分段判型。
Step 4:逐帧细看
对看不懂或细节不清的地方:
- 让用户切更密的帧(fps=1 即每秒一帧)看过渡
- 对关键帧做区域放大描述:画面主体在哪、文字在哪、动效触发时机
- 如果用户提供了更密的帧,逐帧描述变化
Step 5:逐段填表
按时间线,分段填写下表。表格字段随 Step 1 选的维度动态调整。
| 时间段 | 画面描述 | 台词/文案 | 图形/版式 | 节奏/卡点 | 音效/配乐 | 技术推断 |
|---|
| 00:00-00:15 | ... | ... | ... | ... | ... | ... |
| 00:15-00:30 | ... | ... | ... | ... | ... | ... |
规则:
- 每个时间段一个"节拍"(beat),以节奏切换或信息单元为界
- 技术推断列:尽量从画面反推用的工具(如"剪映关键词动画"、"AE Saber 插件")
- 不确定的技术点标注
[待确认]
Step 6:出报告
最终产出两份内容:
产出 1:拉片报告
# 视频拉片报告:《{视频标题}》
## 封面
- {关键帧截图}
- 博主:{名称} | 时长:{MM:SS} | 类型:{口播/教程/...}
## 一句话结论
{这条视频最牛逼的一点是什么,为什么有效}
## 可复刻度
- ⭐⭐⭐⭐⭐ {维度1:可以直接照搬}
- ⭐⭐⭐⭐ {维度2:稍作调整就能用}
- ⭐⭐⭐ {维度3:需要一定技能基础}
- ...
## 关键发现
1. {发现1}
2. {发现2}
3. {发现3}
## 逐段对照表
{Step 5 的完整表格}
## 工具链推断
| 环节 | 推断工具 | 确定度 | 替代方案 |
|------|---------|-------|---------|
| 剪辑 | ... | 高 | ... |
| 调色 | ... | 中 | ... |
| 字幕 | ... | 高 | ... |
| 特效 | ... | 低 | ... |
## 后续建议
- {如果想深入,可以额外分析的点}
产出 2:复现 SOP
# 复现 SOP:{视频标题}
## 前置准备
- [ ] {准备项1}
- [ ] {准备项2}
## 执行步骤
### Phase 1:{阶段名}
1. {具体操作}
2. {具体操作}
### Phase 2:{阶段名}
1. {具体操作}
...
## 关键参数
- 时长:{MM:SS}
- 节拍数:{N} 个
- 建议 BGM:{推荐}
- 字幕风格:{描述}
## 耗时估算
| 阶段 | 预估时间 |
|------|---------|
| 脚本 | ... |
| 拍摄 | ... |
| 剪辑 | ... |
| 后期 | ... |
| 合计 | ... |
适用场景
- 干货类、教程类、横屏单人视频效果最好
- 竖屏短视频也能拆但节奏更快、维度更少
- 不适合:纯叙事电影、MV、直播录屏
成本参考
- 拆一条 30 分钟视频约消耗 40 万 token(含帧描述 + 表格 + 报告)
- 使用 Claude Opus 4.x 约 25 元人民币
- 拆 3~5 条同博主视频基本能还原对方完整工作流
与用户交互
- 先让用户提供视频文件路径或关键帧截图
- 确认要拆的维度(Step 1)
- 如果用户还没抽帧,给出 ffmpeg 命令让用户执行后提供截图目录
- 逐段分析过程中,遇到不确定的技术点要主动提问
- 报告生成后,问用户要不要进一步深入某个段落或维度