| name | talking-head-cut |
| description | 口播类视频(口播/演讲/访谈/直播)的轻剪辑——ASR 转写拿逐字时间戳,去口气词/结巴/静音,或识别高光段剪成集锦。仅做基于人声的轻剪辑,不出脚本不烧字幕;纯画面类素材的集锦剪辑走 video-edit。 |
| metadata | {"openclaw":{"emoji":"🎙️","requires":{"bins":["python3","ffmpeg","ffprobe"]}}} |
口播视频轻剪辑(talking-head-cut)
适用场景
用户提供一段有人说话的视频(口播、演讲、访谈、直播回放等),要求:
- 去口气词:删掉嗯/呃/结巴/长静音/假起头/重复句,让口播更干净(
--mode filler)
- 高光剪辑:自动识别精彩发言段,剪接成短集锦(
--mode highlight)
- 两者都要:先去口气词再标高光(
--mode both)
典型输入:一段 5–60 分钟的口播视频 + 目标时长(如"剪成 60 秒的高光集锦")。
不适用:
- 视频没有人声、或精彩与否要看画面而不是听内容 → 走
video-edit 的画面集锦流程
- 用户已经明确告诉剪哪几段 → 直接用
video-edit extract 手工抽段拼接
- 需要从零生产视频 → 委托 content-producer
- 需要烧字幕、加 BGM → 剪完后走
video-edit subtitles / video-edit audio-mix(BGM 来源优先公共 bgm-library 技能:bgm-library pick "<主题>" 选曲下载,免 key、免版税、自动署名;定制风格用 aigc-video-gen music)
工作区
在 output_videos/ 下建项目文件夹:
output_videos/<project-en-slug>/
├── source.mp4 # 用户提供的原始视频(重命名后的副本或软链)
├── cut_plan.json # 检测产物:[{keep, start, end, reason}]
└── highlight.mp4 # 最终成片
流程
Step 1:检测生 cut_plan.json
talking-head-cut <source.mp4> \
--mode highlight \
--language zh \
--output <project-dir>/cut_plan.json