ai
根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Menu
根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨
Install with Codex or Claude Copy this prompt, paste it into Codex, Claude, or another assistant, and let it review the skill page and install it for you.
Based on SOC occupation classification
根据视频情绪/风格从音乐库中自动匹配合适的 BGM 并混音,支持 ducking
基于豆包大模型 ASR(LAS-ASR-PRO)的高精度语音转写:支持视频自动抽取音轨、降噪预处理、超大文件与超长时长、 TOS 内网路径(tos://)输入;输出带时间戳的分句 JSON,可选说话人分离、情感/性别/语速、敏感词过滤等扩展分析。 异步 submit/poll。适用于台词精转、会议纪要、多语言音视频(支持多格式与自动语种检测)。需 LAS 侧鉴权与算子配置。
从视频或纯音频中提取音轨,并按固定时长切分;支持 wav/mp3/flac 等格式转换,输入输出可对接 TOS。 需 LAS_API_KEY。适用于批量抽音频、等长分段、给 ASR/剪辑流水线备料。
按自然语言描述从长视频中抽取片段:高光、指定场景、参考图找人/找物、长视频语义分段与带时间戳的摘要。 支持参考图锁定目标,结果多为 TOS 上的剪辑 URL。需 LAS_API_KEY 与算子区域配置。适合云端粗剪、素材初筛与自动化拆条。
OpenClaw 系统诊断和性能分析工具。分析 agent 推理耗时、Token 用量、工具调用统计、 Run 时间线、Gateway 重启历史。支持多种模式:批量分析(默认)、实时跟踪(-f)、 摘要统计(-s)、高级诊断(--advanced)。支持多 Agent 过滤。 使用场景:当用户询问 OpenClaw 运行状态、性能瓶颈、推理延迟、Token 消耗、 工具执行统计、错误排查、agent 活动分析时触发。 触发词:诊断、diagnostics、性能分析、推理耗时、token统计、运行状态、 agent分析、工具调用统计、Run详情、Gateway重启。 指令触发:/diag — 直接执行诊断,支持参数透传。
使用豆包 Seedance 模型进行文生视频、图生视频(首尾帧)及多模态参考(图/音/视频)生成短片。 当用户需要从零生成视频、根据图片延展成片、或带参考素材生成视频时使用。 需配置 ARK_API_KEY,或 MODEL_VIDEO_API_KEY / MODEL_AGENT_API_KEY;可选 MODEL_VIDEO_API_BASE、MODEL_VIDEO_NAME。
| name | AI 解说配音 |
| description | 根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨 |
| trigger | AI解说、配音、旁白、narration、解说 |
| tags | ["narration","tts","voice","dubbing"] |
| icon | 🎙️ |
为短剧投流素材生成与画面匹配的解说配音:先分析视频内容,再生成解说词脚本,经 Ark TTS 合成后替换原音轨。要求声音有吸引力,与画面节奏一致。
.env 中配置 ARK_API_KEY(用于视频分析与文案生成)。ARK_TTS_ENDPOINT 或 ARK_TTS_MODEL 用于语音合成;未配置时仅生成文案和占位静音,便于后续接入真实 TTS。zh_female_huayan。*_narration.mp4(原画面 + 新解说音轨)。*_script.txt 与占位音频。