ai
根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Menú
根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Basado en la clasificación ocupacional SOC
根据视频情绪/风格从音乐库中自动匹配合适的 BGM 并混音,支持 ducking
基于豆包大模型 ASR(LAS-ASR-PRO)的高精度语音转写:支持视频自动抽取音轨、降噪预处理、超大文件与超长时长、 TOS 内网路径(tos://)输入;输出带时间戳的分句 JSON,可选说话人分离、情感/性别/语速、敏感词过滤等扩展分析。 异步 submit/poll。适用于台词精转、会议纪要、多语言音视频(支持多格式与自动语种检测)。需 LAS 侧鉴权与算子配置。
从视频或纯音频中提取音轨,并按固定时长切分;支持 wav/mp3/flac 等格式转换,输入输出可对接 TOS。 需 LAS_API_KEY。适用于批量抽音频、等长分段、给 ASR/剪辑流水线备料。
按自然语言描述从长视频中抽取片段:高光、指定场景、参考图找人/找物、长视频语义分段与带时间戳的摘要。 支持参考图锁定目标,结果多为 TOS 上的剪辑 URL。需 LAS_API_KEY 与算子区域配置。适合云端粗剪、素材初筛与自动化拆条。
OpenClaw 系统诊断和性能分析工具。分析 agent 推理耗时、Token 用量、工具调用统计、 Run 时间线、Gateway 重启历史。支持多种模式:批量分析(默认)、实时跟踪(-f)、 摘要统计(-s)、高级诊断(--advanced)。支持多 Agent 过滤。 使用场景:当用户询问 OpenClaw 运行状态、性能瓶颈、推理延迟、Token 消耗、 工具执行统计、错误排查、agent 活动分析时触发。 触发词:诊断、diagnostics、性能分析、推理耗时、token统计、运行状态、 agent分析、工具调用统计、Run详情、Gateway重启。 指令触发:/diag — 直接执行诊断,支持参数透传。
使用豆包 Seedance 模型进行文生视频、图生视频(首尾帧)及多模态参考(图/音/视频)生成短片。 当用户需要从零生成视频、根据图片延展成片、或带参考素材生成视频时使用。 需配置 ARK_API_KEY,或 MODEL_VIDEO_API_KEY / MODEL_AGENT_API_KEY;可选 MODEL_VIDEO_API_BASE、MODEL_VIDEO_NAME。
| name | AI 解说配音 |
| description | 根据视频内容生成与画面匹配的解说旁白,使用 Ark TTS 合成有吸引力的配音并替换原音轨 |
| trigger | AI解说、配音、旁白、narration、解说 |
| tags | ["narration","tts","voice","dubbing"] |
| icon | 🎙️ |
为短剧投流素材生成与画面匹配的解说配音:先分析视频内容,再生成解说词脚本,经 Ark TTS 合成后替换原音轨。要求声音有吸引力,与画面节奏一致。
.env 中配置 ARK_API_KEY(用于视频分析与文案生成)。ARK_TTS_ENDPOINT 或 ARK_TTS_MODEL 用于语音合成;未配置时仅生成文案和占位静音,便于后续接入真实 TTS。zh_female_huayan。*_narration.mp4(原画面 + 新解说音轨)。*_script.txt 与占位音频。