一键导入
laohan-luping
口播稿转录屏脚本(CLI+浏览器),自动生成ffmpeg录制脚本并输出MP4。Use when 用户说"录屏""录制教程""录视频""录一段""screen record""补录""口播稿转录屏""浏览器录屏""录网页"或提到录制Claude Code画面或浏览器操作。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
菜单
口播稿转录屏脚本(CLI+浏览器),自动生成ffmpeg录制脚本并输出MP4。Use when 用户说"录屏""录制教程""录视频""录一段""screen record""补录""口播稿转录屏""浏览器录屏""录网页"或提到录制Claude Code画面或浏览器操作。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
| name | laohan-luping |
| description | 口播稿转录屏脚本(CLI+浏览器),自动生成ffmpeg录制脚本并输出MP4。Use when 用户说"录屏""录制教程""录视频""录一段""screen record""补录""口播稿转录屏""浏览器录屏""录网页"或提到录制Claude Code画面或浏览器操作。 |
| version | 1.2.0 |
输入一篇口播稿(或录屏指示),自动生成 bash 录屏脚本。脚本编排 CLI 操作(tmux+Claude Code)和浏览器操作(Playwright headed),ffmpeg 录物理屏幕,输出 1080p MP4。
口播稿即脚本蓝图。 每段口播对应一个屏幕操作(CLI 命令/浏览器导航/静态等待),从口播稿里提取出操作序列和时长,填入录制模板。
看到什么录什么。 ffmpeg 录物理屏幕,tmux 前台显示终端,Playwright headed 显示浏览器。两种"演员"按口播稿交替出场。
录屏是素材,不是生产。 录制过程中的临时文件全部自动清理,只保留最终 MP4。
接收用户提供的:
script.md)录屏指示.md)如果用户提供了口播稿但没有录屏指示 → 根据口播稿内容自动推断每段对应的操作。 如果用户提供了录屏指示 → 直接用指示里的操作序列。
从口播稿/录屏指示中提取。操作分为三种类型:
CLI 操作(tmux + Claude Code):
| 口播段落 | 屏幕操作 | 脚本动作 |
|---|---|---|
| "说「抓今天的AI精选」" | 执行命令 | send_cmd "抓今天的AI精选" |
| "说「帮我写口播稿」" | 执行命令 | send_cmd "帮我写口播稿" |
| "展示 output/ 文件夹" | 查看命令 | send_cmd "ls output/" |
浏览器操作(Playwright headed):
| 口播段落 | 屏幕操作 | 脚本动作 |
|---|---|---|
| "打开 GitHub 项目页" | 导航到 URL | browser_goto "https://github.com/..." |
| "看一下 README" | 页面滚动 | browser_scroll 500 |
| "点击安装文档" | 点击链接 | browser_click "a[href='docs']" |
| "展示项目截图" | 静态展示 | browser_wait 3000 |
静态操作(纯等待):
| 口播段落 | 屏幕操作 | 脚本动作 |
|---|---|---|
| 开场白/过渡/结尾 | 静态画面 | sleep N |
提取规则:
引号里的内容(「」或"")→ 直接作为 send_cmd 的参数
提到 URL / GitHub / 网站 / 文档 → 浏览器操作
提到终端/命令/CLI → CLI 操作
纯叙述段落 → 按口播时长估算 sleep 秒数(正常语速约 3 字/秒)
CLI 命令需要等 Claude 完成的 → 加 wait_for_claude
浏览器页面需要阅读时间的 → 加 browser_wait
完成条件: 生成结构化的操作列表,每条含类型(cli/browser/static)、内容、等待方式、标签
which ffmpeg && which tmux && which node
ffmpeg -f avfoundation -list_devices true -i "" 2>&1 | grep "Capture screen"
node -e "require('playwright')" 2>/dev/null && echo "playwright OK" || echo "playwright missing"
npm install playwright基于 scripts/record_template.sh 模板生成。模板包含:
send_cmd()、wait_for_claude()、browser_*() 函数填充内容:
browser_actions.json)如果只有 CLI 段 → 纯 CLI 模式(不启动浏览器)。 如果只有浏览器段 → 纯浏览器模式(不启动 tmux)。 两者都有 → 混合模式。
生成脚本写到用户指定目录(或当前目录),文件名格式:record_<教程名>.sh
输出:
record_xxx.sh 脚本(含 browser_actions.json 如有浏览器段)bash record_xxx.sh不自动执行脚本 — 录屏需要用户手动在终端启动。
{
"viewport": { "width": 1920, "height": 1080 },
"steps": [
{ "action": "goto", "url": "https://github.com/xxx", "label": "打开项目页" },
{ "action": "wait", "ms": 3000 },
{ "action": "scroll", "pixels": 600, "smooth": true },
{ "action": "wait", "ms": 2000 },
{ "action": "click", "selector": "a[href='/xxx/docs']", "label": "点击文档" },
{ "action": "wait", "ms": 3000 }
]
}
支持的 action:goto、wait、scroll、click。
| 问题 | 原因 | 解决 |
|---|---|---|
| 录错屏幕 | 多显示器索引不对 | ffmpeg -list_devices 确认 |
| tmux 里 claude 立即退出 | 网络/初始化偶发问题 | 重跑 |
| 画面静止 | claude 等待输入 | 手动按回车 |
| 视频太大 | CRF 值太低 | 改 -crf 23 |
| 命令没发完 | 超时 | 增大 max_wait |
| 浏览器窗口尺寸不对 | viewport 不匹配 | JSON 里设 viewport |
| Playwright 启动失败 | 未安装 | npm install playwright |
统一创作引擎,负责确定来源+创作口播初稿(不含封面提示词,封面由 laohan-fengmianqiuzhi 独立产出)。支持录屏视频(音频提取→转录)、URL队列(抓取→整理)、热点转译(选题→大纲)、结构化大纲、原始文本、自由主题六种输入。其他 skill 的写作环节统一调用本 skill。Use when 用户说"写口播稿""帮我写""录屏转口播""视频转口播稿""找选题""写一篇""热点""想做个视频""根据链接改写""改写文档""不知道拍什么"。
从互联网拿内容一站式——视频下载、音频提取+转文字、字幕下载、评论采集、博主数据、网页抓取、搜索聚合、跨平台发布与数据分析,覆盖 30+ 平台(抖音/TikTok/YouTube/B站/小红书/知乎/公众号/视频号/微博/Reddit/HackerNews/即刻/知识星球/雪球/贴吧/头条/Twitter等),按降级链自动选择最优工具。Use when 用户说"下载""下个视频""帮我抓""抓一下""爬""爬取""读一下""读这个链接""看看这个网址""搜一下""搜索""查一下""帮我查""转文字""转录""听写字幕""评论""看看评论""抓评论""博主数据""博主更新""up主""谁谁最近发了什么""封面""发抖音""发小红书""定时发布""草稿""账号数据""粉丝数""给我截图""网页正文""这个页面讲了啥",或给出任意 URL / 短链接 / BV号 / 视频号链接 / 公众号文章链接 要求获取内容,或提到抖音/TikTok/YouTube/B站/小红书/知乎/公众号/视频号/微博 等具体平台名要求下内容、搜内容、读评论、抓数据,以及任何涉及从互联网拿内容的操作。优先按降级链选工具:搜索走 anysearch→opencli→agent-reach;下载按平台路由;抓取走 Scrapling→browser-use→web-access。
从口播稿+真人视频生成带B-roll overlay的最终视频。一个index.html+一次render出成片。Use when 用户说生成B-roll、做视频片段、配图动画、Hyperframes动画、教程配图、给视频加特效、做overlay、加动效。
创建、优化、评分 Claude Code agent skills 的元 skill(三位一体)。创建从构思到发布全流程;6 维量化评分(frontmatter/工作流/失败模式/检查点/具体性/反例);迭代优化只保留涨分改动。Use when 用户说"创建skill""写一个skill""新建skill""改skill""优化skill""给skill打分""评分""评估skill质量""skill体检""review skill"或提到 skill 创建/优化/评分相关任何意图。
将口播稿/文章改写为多平台版本。当用户说"多平台改写"、"改成多平台版本"、"改成三个平台"、"适配多平台"、"转抖音版"、"转小红书版"、"转公众号版"时触发。输入一段口播稿或文章,输出抖音、小红书、公众号三个平台的适配版本。
教程路由器,输入关键词加载对应配置教程并按步骤引导安装。覆盖 claude-mem、CLAUDE.md、Chrome Gemini 侧边栏、Claude Code + 智谱 GLM、ECC 插件安装维护。Use when 用户说"教程""怎么配置""安装教程""怎么装"或提到"claude-mem""ecc""glm""gemini侧边栏""CLAUDE.md"等具体工具名+配置需求。