bgm
根据视频情绪/风格从音乐库中自动匹配合适的 BGM 并混音,支持 ducking
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Menu
根据视频情绪/风格从音乐库中自动匹配合适的 BGM 并混音,支持 ducking
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Based on SOC occupation classification
根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨
基于豆包大模型 ASR(LAS-ASR-PRO)的高精度语音转写:支持视频自动抽取音轨、降噪预处理、超大文件与超长时长、 TOS 内网路径(tos://)输入;输出带时间戳的分句 JSON,可选说话人分离、情感/性别/语速、敏感词过滤等扩展分析。 异步 submit/poll。适用于台词精转、会议纪要、多语言音视频(支持多格式与自动语种检测)。需 LAS 侧鉴权与算子配置。
从视频或纯音频中提取音轨,并按固定时长切分;支持 wav/mp3/flac 等格式转换,输入输出可对接 TOS。 需 LAS_API_KEY。适用于批量抽音频、等长分段、给 ASR/剪辑流水线备料。
按自然语言描述从长视频中抽取片段:高光、指定场景、参考图找人/找物、长视频语义分段与带时间戳的摘要。 支持参考图锁定目标,结果多为 TOS 上的剪辑 URL。需 LAS_API_KEY 与算子区域配置。适合云端粗剪、素材初筛与自动化拆条。
OpenClaw 系统诊断和性能分析工具。分析 agent 推理耗时、Token 用量、工具调用统计、 Run 时间线、Gateway 重启历史。支持多种模式:批量分析(默认)、实时跟踪(-f)、 摘要统计(-s)、高级诊断(--advanced)。支持多 Agent 过滤。 使用场景:当用户询问 OpenClaw 运行状态、性能瓶颈、推理延迟、Token 消耗、 工具执行统计、错误排查、agent 活动分析时触发。 触发词:诊断、diagnostics、性能分析、推理耗时、token统计、运行状态、 agent分析、工具调用统计、Run详情、Gateway重启。 指令触发:/diag — 直接执行诊断,支持参数透传。
使用豆包 Seedance 模型进行文生视频、图生视频(首尾帧)及多模态参考(图/音/视频)生成短片。 当用户需要从零生成视频、根据图片延展成片、或带参考素材生成视频时使用。 需配置 ARK_API_KEY,或 MODEL_VIDEO_API_KEY / MODEL_AGENT_API_KEY;可选 MODEL_VIDEO_API_BASE、MODEL_VIDEO_NAME。
| name | BGM 自动匹配 |
| description | 根据视频情绪/风格从音乐库中自动匹配合适的 BGM 并混音,支持 ducking |
| trigger | BGM、背景音乐、自动配乐、匹配BGM |
| tags | ["bgm","music","mood"] |
| icon | 🎵 |
分析视频情绪(可选 Ark 多模态),从 assets/bgm/ 音乐库中按风格匹配最合适的 BGM,并调用混音脚本叠加到视频,支持对白段自动 ducking。
assets/bgm/,可选在同目录创建 bgm_index.json 标注 emotion/style。.env 中配置 ARK_API_KEY 用于画面情绪分析;未配置时使用默认风格匹配。*_bgm.mp4(原视频 + 匹配 BGM,对白处自动压低 BGM)。