asset-management
管理火山方舟素材资产库(Assets:图片/音频/视频),通过 asset:// 引用喂给 Seedance 2.0 多模态视频生成,解决真人肖像审核 + 妆造漂移 + 音色漂移三类问题。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
管理火山方舟素材资产库(Assets:图片/音频/视频),通过 asset:// 引用喂给 Seedance 2.0 多模态视频生成,解决真人肖像审核 + 妆造漂移 + 音色漂移三类问题。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
多段视频拼接的后期工艺指南——audio-fadein(消除 Seedance 启动底噪)、crossfade(视频/音频淡变)、loudnorm(音量归一化)。当用户拼完多个 clip 但效果不连贯(音量跳、画面跳、底噪嗡嗡声)时调用,对应 changdu clip-concat 命令。
动漫武打短剧(≤30s)专项 prompt 写作与生成工作流。当需要做日漫/国漫风格的短打戏、追逐戏、对决戏,且要求段间动作与镜头无缝衔接时调用。配套使用 changdu sequential-generate(continuity-mode auto)+ clip-concat(--audio-fadein 消除底噪,crossfade + loudnorm 可选)。
生成服务于叙事与角色内核的角色设计图,16:9横版三视图模式。反模板反套路,让角色有记忆点和辨识度。
Intelligent long text novel reader with smart content filtering and detailed asset extraction. Invoke when user wants to read or analyze long novels. Automatically skips irrelevant content and extracts detailed character/item/scene information.
文学作品到影视视频的自然语言工作流;生成链路统一使用 changdu CLI。支持漫剧和真人剧两种模式。
将文字分镜逐条强化为 Seedance 2.0 视频提示词。已完成文字分镜且需要落地为可执行视频提示词时调用。
| name | asset-management |
| description | 管理火山方舟素材资产库(Assets:图片/音频/视频),通过 asset:// 引用喂给 Seedance 2.0 多模态视频生成,解决真人肖像审核 + 妆造漂移 + 音色漂移三类问题。 |
| homepage | https://www.volcengine.com/product/ark |
| metadata | {} |
Seedance 2.0 reference-to-video 模型支持单次请求混传 ≤9 张图 + ≤3 段视频 + ≤3 段音频。Assets API 提供可信素材通道:把素材入库后用 asset://<id> 引用,相比直接传 URL 有三大好处:
reference_image / reference_video / reference_audio 都接受 asset://export VOLC_ACCESSKEY="你的火山引擎 Access Key"
export VOLC_SECRETKEY="你的火山引擎 Secret Key"
export CHANGDU_TOS_BUCKET="你的TOS桶名" # asset-create --file 需要
export CHANGDU_ARK_API_KEY="你的火山方舟API Key" # 视频生成需要
每个项目/角色组创建一个 Asset Group:
changdu asset-group-create --name "寸金入骨-角色组"
返回 素材组ID: group-2026xxxx-xxxxx。
上传面部特写、三视图、服装细节等。每种参考单独一张图效果最佳:
# 从本地文件上传(自动走 TOS)
changdu asset-create --file ./角色/女主_面部特写.jpg --group-id <素材组ID> --type Image --name "沈锦-面部"
changdu asset-create --file ./角色/女主_三视图.jpg --group-id <素材组ID> --type Image --name "沈锦-妆造"
changdu asset-create --file ./场景/会议室.jpg --group-id <素材组ID> --type Image --name "会议室场景"
# 从 URL 上传
changdu asset-create --url "https://example.com/actor.jpg" --group-id <素材组ID> --type Image
命令默认 --wait,等待处理完成后返回引用 URL:
素材ID: asset-2026xxxx-xxxxx 状态: 可用
引用URL: asset://asset-2026xxxx-xxxxx
主角的音色样本入库后,在每段 clip 生成时用 --voice-asset 或 --ref-audio 引用,是消除"音色每段不同"穿帮的核心手段。
changdu asset-create \
--file ./音色/沈锦_台词样本.mp3 \
--group-id <素材组ID> \
--type Audio \
--name "沈锦-音色v1"
如果第一段视频已经生成,并且其中的音色满意,可以一键完成"抽音色 → 上传 TOS → 入库 Audio Asset":
changdu voice-asset-from-clip \
--input ./单集制作/EP001/视频_Clip001.mp4 \
--group-id <素材组ID> \
--start 6 --duration 8 \
--name "沈锦-音色-from-Clip001"
输出包含可直接复用的 ID:
音色 Asset ID: asset-xxxxxxxx
asset:// 引用: asset://asset-xxxxxxxx
复用方式:
changdu sequential-generate ... --voice-asset asset-xxxxxxxx
changdu multimodal2video ... --ref-audio asset-xxxxxxxx
如果有"想要的运镜风格""指定的动作动力学"等参考视频,也可以入库后用 --ref-video 引用:
changdu asset-create \
--file ./参考视频/慢推镜样本.mp4 \
--group-id <素材组ID> \
--type Video \
--name "运镜-慢推"
注意视频参考素材:
在视频生成命令中用 --asset 替代 --image,并叠加 --ref-video / --ref-audio / --voice-asset:
changdu multimodal2video \
--asset asset-2026xxxx-face \
--asset asset-2026xxxx-costume \
--asset asset-2026xxxx-scene \
--ref-video asset-2026xxxx-prevtail \
--voice-asset asset-2026xxxx-voice \
--prompt "图片1的女孩(妆造参考图片2)站在图片3的场景中。视频1 是上一段尾段,仅做妆造与位置参考。音轨1 锁音色。$(cat 视频_Clip004.prompt.txt)" \
--ratio 16:9 --duration 15 --wait --output clip004.mp4
也可混合使用 --image 和 --asset:
changdu multimodal2video \
--asset asset-2026xxxx-face \
--image ./新场景.jpg \
--prompt "图片1的女孩站在图片2的场景中" \
--wait --output clip.mp4
# 查看素材状态(图片/音频/视频通用)
changdu asset-get --id <素材ID>
# 列出全部素材
changdu asset-list
# 按素材组过滤
changdu asset-list --group-id <素材组ID>
# 列出素材组
changdu asset-group-list
# 删除素材
changdu asset-delete --id <素材ID>
根据官方文档,上传素材时应拆分上传以提高模型识别精度:
| 素材类型 | 说明 | 建议 | 抗穿帮维度 |
|---|---|---|---|
| 图:面部特写 | 无表情、正面、高清 | 必须单独一张 | CHARACTER |
| 图:妆造三视图 | 正面+侧面+背面 | 建议单独一张 | MAKEUP |
| 图:服装细节 | 特写 | 可选单独一张 | PROP |
| 图:场景参考 | 背景环境 | 单独一张 | SCENE |
| 音:音色样本 | 6-10s 干净人声 | 主角 1-2 段 | VOICE |
| 视:前段尾段 | ≤5s 自动抽取 | 由 clip-extract-tail 产出 | CHARACTER+MAKEUP+SCENE 三合一 |
| 视:运镜模板 | ≤15s 风格参考 | 可选 | DETAIL(运镜风格) |
Prompt 中使用 图片1 / 视频1 / 音轨1 指代素材,顺序与 --asset / --ref-video / --ref-audio 传入顺序一致;同时建议在 prompt 内的【视频参考说明】【音色锚定】块用自然语言告诉模型每个素材的语义角色。
Active 后方可使用。generate-video-by-seedance:视频生成(配合 --asset / --ref-video / --ref-audio 参数)upload-to-tos:上传到 TOS(asset-create --file 内部依赖)novel-to-video:全流程工作流(真人剧路径,含音色样本入库流程)video-review:穿帮审查与修复(含 VOICE / MAKEUP 类)