一键导入
ref-analyze
参考视频解析(P0)。下载某 UP 主的视频,做秒级拆解——语音转文字、镜头切换点、响度节奏——并输出结构化分析报告(钩子位置、节奏、信息密度、可复用的结构 SOP)。当用户说"分析这个视频/参考一下这个 up 主/拆解这条视频的结构"时使用。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
参考视频解析(P0)。下载某 UP 主的视频,做秒级拆解——语音转文字、镜头切换点、响度节奏——并输出结构化分析报告(钩子位置、节奏、信息密度、可复用的结构 SOP)。当用户说"分析这个视频/参考一下这个 up 主/拆解这条视频的结构"时使用。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
使用本机 Qwen3-TTS 做预设音色、纳西妲跨语言克隆、整稿/SRT/视频配音,并在稳定 CPU 生产版与 Transformers 5 + Intel Arc XPU 实验版之间安全路由。用户说“配音、朗读、纳西妲说中文/英文/日语/俄语、TTS、Qwen3-TTS、XPU/GPU 加速、预热或测速”时使用。
找 skill 的 skill。当用户说"有没有干X的skill/帮我找个skill/还有哪些skill能用/怎么装skill"时,在本地已下载的 skill 目录里检索匹配,给出用途+来源+安装方法。
选题与标题生成(P1)。基于参考分析和账号定位,产出多个选题方向和每个选题的多版标题(对比打分),含横竖屏/多语言考量。当用户说"想选题/起标题/这个方向有哪些角度"时使用。
剪辑自动化(P2)。ffmpeg 脚本做粗剪、卡点、字幕烧录、横竖屏双版本导出,走 Intel Arc QSV 硬件编码。跳舞视频的音乐卡点也在这里。当用户说"粗剪/烧字幕/导竖屏版/卡点"时使用。
视频本地化编排器(P2,部分实现)。把一条视频本地化为目标语言:转录→翻译→(配音)→烧字幕→竖屏导出。当用户说"帮我把这个视频做成中文字幕/翻译成英文/配俄语音/全套本地化"时使用。注意:翻译/配音步骤尚未自动化,由 Claude 手工完成或待补脚本。
数据复盘(P3)。记录每条视频的标题/封面/开头/各平台数据,分析哪类标题、封面、开场留存更好,沉淀规律反哺选题。当用户说"复盘/记录数据/哪种开头效果好"时使用。
| name | ref-analyze |
| description | 参考视频解析(P0)。下载某 UP 主的视频,做秒级拆解——语音转文字、镜头切换点、响度节奏——并输出结构化分析报告(钩子位置、节奏、信息密度、可复用的结构 SOP)。当用户说"分析这个视频/参考一下这个 up 主/拆解这条视频的结构"时使用。 |
把一条优秀视频拆成可学习的结构,沉淀成 SOP。面向 Vlog 与科普两类(需要结构/节奏借鉴的)。
用户给一个视频链接(B站/抖音/YouTube/TikTok),想学它的开场钩子、节奏、信息密度、分段结构。
tools/transcribe_dispatch.py(自动路由),走 venv(勿用系统 Python 3.14)reference/<slug>/.\.claude\skills\ref-analyze\scripts\fetch.ps1 -Url "<链接>" -Slug "<up主-选题名>"
产出:reference/<slug>/ 下的 video.mp4、audio.wav、*.info.json、缩略图。
# 推荐:自动路由 — 中文走 FunASR(高准确率+标点),其他走 faster-whisper
.\tools\.venv\Scripts\python.exe .\tools\transcribe_dispatch.py ".\reference\<slug>\audio.wav" --lang auto
# 或手动指定引擎:
.\tools\.venv\Scripts\python.exe .\tools\transcribe.py ".\reference\<slug>\audio.wav" --lang auto # faster-whisper
.\tools\.venv\Scripts\python.exe .\tools\transcribe_funasr.py ".\reference\<slug>\audio.wav" --lang zh # FunASR
产出:audio.srt(字幕,FunASR 已带标点)、audio.json(段级时间戳)。
.\.claude\skills\ref-analyze\scripts\probe.ps1 -Dir ".\reference\<slug>"
.\.claude\skills\ref-analyze\scripts\extract_frames.ps1 -Video ".\reference\<slug>\video.mp4" -OutDir ".\reference\<slug>\frames" -Cuts ".\reference\<slug>\cuts.txt" -MaxFrames 120
产出:cuts.txt(镜头切换)、rms.txt(响度包络)、frames/(关键帧图片,供 Claude 视觉分析)。
读取 audio.json + cuts.txt + rms.txt + *.info.json + frames/*.jpg,按下面模板写 analysis.md。
把转录文本按时间轴对齐镜头切换点和抽帧画面,标注:
# 分析:<标题>
- 来源/UP主/时长/播放量(取自 info.json)
## 一句话结构
<金字塔顶:这条视频靠什么留住人>
## 秒级时间轴(含视觉)
| 时间 | 镜# | 帧图 | 画面内容 | 口播要点 | 镜头/动效 | 功能 |
|---|---|---|---|---|---|---|
| 0:00-0:06 | 1 |  | ... | ... | 特写/推拉 | 钩子 |
## 节奏数据
- 总镜头数 / 平均镜头时长 / 语速(字/分) / 信息密度
- BGM 能量曲线 / 高潮点 / 留白段
## 钩子拆解
<前 8 秒逐句分析,含对应帧画面>
## 视觉手法总结
- 主色调 / 字体风格 / 转场方式 / 图形特效
- 竖屏适配建议(9:16 裁切/重构方案)
## 可复用 SOP
1. ...
2. ...
## 我能直接抄的点 / 我会改的点
--cookies-from-browser。--lang auto 即可,whisper 支持中俄英日。