| name | image-fusion |
| description | 多单品融合成一整套 Look。最多 8 张单品图 → 同一模特身上的完整搭配商拍图,每件单品保真。当用户说「多件搭配」「融图」「组一套 look」「搭配图」「几件衣服合成一张」时使用。 |
image-fusion — 多单品自由搭配融图
一次给最多 8 张单品图,融合成同一个模特身上的一整套 Look。
和 flat-lay 的「多件上身」(只支持上装+下装两张)不同,本技能是任意品类的自由组合:毛衣 + 阔腿裤 + 帽子 + 项链 + 包 + 鞋,一次出一张完整搭配图。
生成效果示例
| 输入单品 1 | 输入单品 2 | 输入单品 3 |
|---|
 |  |  |
item-sweater.jpg — 军绿麻花针织毛衣 | item-hat.jpg — 彩色编织渔夫帽 | item-necklace.jpg — 珍珠项链 |
实际执行的命令:
dlazy seedream-5.0 \
--prompt '电商搭配商拍图。将参考图中的多件单品组合到同一个模特身上:图1 的军绿色麻花针织圆领毛衣作为上装,图2 的彩色编织渔夫帽戴在头上,图3 的珍珠项链戴在颈部。每件单品必须与参考图完全一致——颜色、织法纹理、图案、材质与细节都不能改。下装自动补一条米白色阔腿长裤,脚穿白色运动鞋。青年亚洲女模特,正面站姿,全身入画,纯浅灰色摄影棚背景,柔和顶光,真实照片质感,无文字无水印。' \
--images docs/image-fusion/item-sweater.jpg docs/image-fusion/item-hat.jpg docs/image-fusion/item-necklace.jpg \
--size 3:4 --resolution 2k \
--save docs/image-fusion/example-output.jpg
输出
example-output.jpg — 3:4 / 2K,5 credits。三件单品同时到位,毛衣的麻花织法、渔夫帽的编织配色与项链的珠径都被保留;未提供的下装与鞋按 prompt 指定补齐。
1、能力边界
| 能力 | 说明 |
|---|
| 单品数量 | 最多 8 张 |
| 品类组合 | 上装 / 下装 / 外套 / 连衣裙 / 鞋 / 包 / 帽子 / 围巾 / 首饰 任意混搭 |
| 参考图(可选) | 决定模特姿势、拍摄角度、景别、场景与光线 |
| 模特图(可选) | 锁定人脸与身材,多套 Look 保持同一个模特 |
| 缺件自动补齐 | 只给上装时,下装与鞋由模型按风格自动搭配 |
不做:不改单品的颜色、图案、材质与版型;不做尺码推荐;不用于伪造他人肖像代言。
2、输入素材规则
生成前先自检这几条硬性约束:
- 大小:20KB ~ 15MB
- 分辨率:大于 400×400
- 格式:jpg / jpeg / png / webp
本技能的素材约束比其他技能宽:
- 数量:最多 8 张
- 大小:20KB ~ 15MB
- 分辨率:不超过 8192×8192
- 格式:jpg / jpeg / png / heic / webp
输入建议
| 做法 | 说明 |
|---|
| ✅ 每张只放一件单品 | 一张图里混着上衣和裤子,模型会分不清该穿哪件 |
| ✅ 纯色/透明背景平铺图 | 干扰最少,颜色最准 |
| ✅ 按穿着顺序传图 | 上装 → 下装 → 外套 → 鞋 → 包 → 配饰,prompt 里的 image N 与之对应 |
| ❌ 同类目重复 | 传两件上衣,模型只会选一件或把它们混在一起 |
| ❌ 已经有人穿着的图 | 会把原模特的身体一起带进来 |
3、单品清单 → prompt 映射
融图的关键是逐件点名:每张图对应一个明确的穿着位置,不点名的单品会被忽略。
图1 → 上装:军绿色麻花针织圆领毛衣(作为上装穿在身上)
图2 → 帽子:彩色编织渔夫帽(戴在头上)
图3 → 项链:珍珠项链(戴在颈部)
未提供 → 下装:自动补米白色阔腿长裤
未提供 → 鞋:自动补白色运动鞋
写成 prompt:
将参考图中的多件单品组合到同一个模特身上:
图1 的<单品描述>作为上装,图2 的<单品描述>戴在头上,图3 的<单品描述>戴在颈部。
每件单品必须与参考图完全一致——颜色、织法纹理、图案、材质与细节都不能改。
下装自动补一条<描述>,脚穿<描述>。
层次冲突要显式排序:同时给外套和上装时写 图2 的外套敞开穿在图1 的上装外面,露出内搭,否则模型会二选一。
4、统一整组视觉
一个店铺往往要出十几套 Look,视觉必须统一,否则详情页看起来像拼凑的。固定这四项:
| 要固定的 | 写法 |
|---|
| 模特 | 传同一张模特图,或 prompt 里固定 青年亚洲女模特,鹅蛋脸,中长黑直发 |
| 姿势与景别 | 传同一张参考图,或固定 正面站姿,全身入画 |
| 背景与光线 | 固定 纯浅灰色摄影棚背景,柔和顶光 |
| 构图留白 | 固定 人物居中,头顶留白约画面高度 8% |
只换单品清单,其余 prompt 一字不改——这样出来的整组图才是一套。
5、工具调用
本技能使用 dLazy 的 seedream-5.0(支持最多 10 张参考图 + 2K/3K/4K 输出,多单品约束场景下性价比最高:单张 5 credits,适合一个店铺跑几十套 Look)。
调用方式
两种等价写法,选一种。统一入口会自动选后端、失败重试、建目录落盘、估算成本:
node scripts/gen.mjs --task image-fusion \
--prompt '<见下方 Prompt 模板>' \
--images <按下表顺序> \
--save output/image-fusion-<sku>.jpg
dlazy seedream-5.0 --prompt '...' --images ... --save output/image-fusion.jpg
参数约定(本技能固定用法)
| 参数 | 取值 | 理由 |
|---|
--images | [单品1, 单品2, …, (参考图), (模特图)],最多 10 张 | 顺序即 prompt 中的 图1 / 图2 / … |
--size | 3:4(全身 Look 主图);1:1(方图主图) | 电商竖版为主 |
--resolution | 2k 日常;3k/4k 印刷或大图详情 | 2K 已够上架 |
--batch | 2 ~ 4 | 多单品组合随机性大,多出几张挑图 |
--save | docs/image-fusion/output-look<N>.jpg | 直接落盘 |
Command Examples
dlazy seedream-5.0 \
--prompt '电商搭配商拍图。将参考图中的多件单品组合到同一个模特身上:图1 的毛衣作为上装,图2 的帽子戴在头上,图3 的项链戴在颈部。每件单品必须与参考图完全一致——颜色、织法纹理、图案、材质与细节都不能改。青年亚洲女模特,正面站姿,全身入画,纯浅灰色摄影棚背景,柔和顶光,真实照片质感,无文字无水印。' \
--images docs/image-fusion/item-sweater.jpg docs/image-fusion/item-hat.jpg docs/image-fusion/item-necklace.jpg \
--size 3:4 --resolution 2k
dlazy seedream-5.0 \
--prompt '电商搭配商拍图。图1 的上装、图2 的下装、图3 敞开外穿的外套、图4 的鞋、图5 的手提包(左手提)、图6 的帽子,全部穿戴到同一个模特身上,外套敞开露出图1 的内搭。每件单品与参考图完全一致,颜色、图案、材质与版型不能改。图7 是姿势与场景参考,图8 是模特脸,人脸与身材沿用图8。真实照片质感,无文字无水印。' \
--images docs/image-fusion/top.jpg docs/image-fusion/bottom.jpg docs/image-fusion/coat.jpg docs/image-fusion/shoes.jpg docs/image-fusion/bag.jpg docs/image-fusion/item-hat.jpg docs/image-fusion/pose.jpg docs/image-fusion/model-face.jpg \
--size 3:4 --resolution 3k \
--batch 4 --save docs/image-fusion/output-look01.jpg
dlazy seedream-5.0 --dry-run --prompt '...' --images a.jpg b.jpg --size 3:4
延伸阅读
6、Prompt 模板
电商搭配商拍图。将参考图中的多件单品组合到同一个模特身上:
图1 的[单品描述]作为[穿着位置],
图2 的[单品描述][穿着位置],
图3 的[单品描述][穿着位置]。
[层次关系,例:图3 的外套敞开穿在图1 的上装外面,露出内搭。]
每件单品必须与参考图完全一致——颜色、织法纹理、图案、材质与细节都不能改。
[缺件补齐,例:下装自动补一条米白色阔腿长裤,脚穿白色运动鞋。]
[模特描述],[姿势与景别],[背景],[光线],真实照片质感,无文字无水印。
按问题追加的修正句
| 问题 | 追加到 prompt 末尾 |
|---|
| 某件单品被漏掉 | 务必同时出现全部 N 件单品:<逐件重述一遍>,缺一件视为失败。 |
| 两件单品混色了 | 图1 与图2 是两件独立单品,颜色不得互相污染:图1 保持<色>,图2 保持<色>。 |
| 层次穿错 | 穿着层次由内到外为:图1 → 图3;图3 必须敞开且能看到图1 的领口与前襟。 |
| 图案位置漂移 | 图案定位:<单品>的<图案>位于<位置>,尺寸约<描述>,不得移动或重复。 |
| 整组视觉不统一 | 保持第四节四项固定描述逐字不变,只替换单品清单 |
7、执行流程
- 拆清单:列出这套 Look 的每一件单品,去掉同类目重复项,确认不超过 8 件。
- 排序传图:按上装 → 下装 → 外套 → 鞋 → 包 → 配饰的顺序,prompt 里的 图N 与
--images 顺序严格对应。
- 点名每一件:一件一句,写清穿着位置;有层次关系的显式排序。
- 补齐缺件:没给下装/鞋就在 prompt 里指定,别让模型自由发挥。
- 固定整组视觉(第四节四项),多套 Look 之间只换单品清单。
--dry-run 估价 → 真跑 → --batch 2~4 挑图,落盘到 docs/image-fusion/。
- 质检:件数是否齐、颜色是否串、层次是否对、图案位置是否漂移。
8、常见问题
| 现象 | 原因 | 处理 |
|---|
| 少穿了一件 | 单品数量多、prompt 没逐件点名 | 逐件点名,并追加「缺一件视为失败」句 |
| 帽子和头发穿模 | 缺少交互描述 | 追加 头发从帽檐下自然垂落,帽子与头顶贴合无缝隙 |
| 两件单品颜色互串 | 色彩相近 | 追加「颜色不得互相污染」句,写死每件的色名 |
| 外套把内搭全挡住 | 未写层次 | 追加层次排序句,要求露出内搭领口与前襟 |
| 整组图风格不统一 | 每次 prompt 都改了背景/光线 | 固定第四节四项描述逐字不变 |
| 单品数量超过 8 | 超出能力 | 拆成两套 Look,或先用 image-fusion 出主体、再用 wear-everything 单独加配饰 |
Tips
Visit https://dlazy.com for more information.