用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
直接命令不会经过审查 Prompt;运行前请先检查来源。
npx skills add https://github.com/waooAI/waoowaoo --skill music-direction命令会保持在同一行。复制前请横向滚动并检查完整内容。
想先保存到本地?可下载 SkillsMP 当前能够提供的文件。
Scope reusable production assets and define stable visible designs from an exact source text.
Apply shared creative fact boundaries, scope control, duration discipline, and delivery checks.
Establish one coherent visual, narrative, directing, editing, sound, and asset direction.
基于 SOC 职业分类
正在显示 SKILL.md
| name | music-direction |
| description | Plan narrative score windows and author precise Eleven Music v2 Composition Plans. |
根据项目中已经锁定的剧情、最终视频提示词、剪辑事实和真实成片时间线,决定哪里需要配乐、哪里不需要配乐,并为每个需要配乐的时间窗口直接写出可执行的 Eleven Music v2 Composition Plan。你是 cue 选择、音乐结构和 Composition Plan 的唯一创作者;执行层只校验、冻结、生成和合成,不会再替你改写或补全音乐设计。
score_timeline 视频 Resource 的真实 duration。channel: "context"、role: "score_timeline" 的完整待配乐视频;该视频不会上传给音乐 Provider,只用于 lineage、时间边界与最终确定性合成。decision: "no_music" 与空 items;也可以只为任意多个不连续窗口创作 cue。本 Skill 声明一个硬对齐检查点:配乐决定。时机是一部超过 15 秒的完整作品的视觉单元全部就绪、且用户尚未决定配乐时。做法:由主 Agent 发起一张卡,给出两到三个具体的配乐方向,推荐项在前,外加一个明确的无配乐选项。无论作品是 16 秒、45 秒还是更长都适用。机械收尾——合成、混入已决定的配乐、打包——不再提问。
只有用户明确选择了配乐方向后才应用本 Skill 生成 cue;只有用户明确选择无配乐后才走 no_music 分支。绝不从沉默、时长、题材或自己的制作计划推断 no_music。
startMs 决定该 cue 在完整视频中的绝对起点。compositionPlan.chunks 是同一次生成内部按顺序连续发生的多个音乐段落。chunk 不是八段提示词,也不是八次生成;它们共同组成一份 JSON Composition Plan,并由一次 Provider 请求生成一条连续音频。chunk.durationMs 之和。不要另写 durationSeconds 或结束时间。text 与 styles 中描述音乐行为;不要承诺 Provider 会在某个具体毫秒命中画面。音乐模型由设置固定,不填写 model。每个 item 主动遵守当前 create_audio 工具 schema 的 chunks 数量、单 chunk 和总计划时长、styles 数量及 contextAdherence 枚举,不依赖服务端报错后再修。
bad_composition_plan 拒绝这类计划。只读取当前工具声明的模型事实;这些值还会由 registry/schema 进行硬校验。若工具不可用或配置模型与当前计划不兼容,停止提交并说明缺口,不猜测、不截断、不自动更换模型。
text 用英文方括号写清段落功能,例如 [Restrained Tension]、[Escalation]、[Unresolved Release]。纯器乐段不写歌词;需要演奏行为时使用清晰的音乐语言。positiveStyles 具体描述流派边界、配器、音区、织体、节奏密度、速度或 BPM、调性/调式、动态、空间与演奏法。第一 chunk 的 styles 最重要,它会建立整条 cue 的总体音色与风格。negativeStyles 主动排除错误情绪、错误配器、俗套、过密频段和人声,例如 vocals、choir、spoken word、trailer hits、heroic brass、triumphant cadence。不要依赖一个笼统的 instrumental 词解决所有排除项。contextAdherence 决定该 chunk 对相邻上下文的跟随强度。需要连续主题和自然演化时通常使用 high;有意制造明显结构转向时才降低,且仍要保持整条 cue 的音乐逻辑。fadeInMs、fadeOutMs 和 gainDb。它们是最终 mixer 的确定性参数,不会发送给音乐 Provider。fadeInMs 与 fadeOutMs 都不能超过该 cue 的 Composition Plan 总时长。进入与退出方式应与剪辑、对白和原生声音关系一致。startMs 放置、按 plan 总时长裁掉编码 padding、在 cue 间保留静音,并对完成的 BGM 总线统一进行对白 ducking。不要在 Composition Plan 中补偿这些机械行为。score_timeline,再从剧情决定配乐窗口,而不是先生成一条全片音乐?startMs + sum(chunk.durationMs) 是否没有越过视频真实 duration?fadeInMs、fadeOutMs、gainDb 与时间线放置是否明确且合理?decision: "no_music"、空 items,并在 overview 或 warnings 中说明叙事理由。mediaType: "audio" item,包含一份完整 compositionPlan、绝对 startMs、淡入淡出、增益,以及恰好一个 score_timeline reference。不要输出根 prompt、durationSeconds、vocalMode、genre、mood 或 bpm;这些已由 Composition Plan 取代。schemaId 为 project.bgm_audio。create_audio,并以确切的 ready 完整视频 Resource 作为 score_timeline;绝不把该视频上传给音乐 Provider。全部 cue Resource 就绪后,用同一个视频版本和全部确切 cue 版本(musicCues)调用一次 merge_videos,交付合成后的视频,而不是散装 cue 文件。outputKind: "audio_generation_batch" 严格 JSON。机器 Schema 是字段、必填项和层级的唯一权威;本 Skill 只说明创作方法和 Provider 真实规则,不复制一份可能漂移的 JSON 模板。本 Skill 负责剧情配乐判断、cue 窗口、Composition Plan、混音意图以及按当前工具 schema 填写每个 item 的创作参数;模型由系统配置决定。能力校验、Operation Plan、报价、Task、durable provider invocation、日志错误码、Resource 终态和最终合成全部由系统既有统一链路负责;不得调用 Provider 的自动 plan/video-to-music 能力另造第二个配乐决策者。