上周有个做服装电商的朋友找我吐槽,说店里上了十几个新款,模特拍了、图也修了,结果卡在做视频上。去外面找拍摄团队,一套衣服拍一条,预算直接翻了几倍。自己用AI生成吧,第一套折腾了大半天,好不容易效果对了,换第二套衣服又要重新调提示词、重新试顺序,感觉每一批货都在从头学一遍。
他问我有没有什么办法,能让这个流程固定下来,以后换衣服、换模特、换场景,不用再从头摸一遍。
我把当时做的一个换装视频Skill丢给他试了试。同一段舞蹈,同一个模特,6套衣服按设定好的顺序连续切换,一套流程跑下来就能拿到成片。这篇文章就拆解这个思路和完整步骤。
项目介绍
这个Skill解决的不是“能不能生成一条换装视频”,而是“能不能稳定地批量生产商品视频”。
它是把一套跳舞换装的流程固定成一个可重复执行的路径:输入参考舞蹈视频、模特图、场景图、多张服装图,输出一条按顺序切换服装的竖屏短视频。同时还会产出中间的换装图、动作时间节点、完整的提示词和素材映射。
面向的是服装电商商家、店铺运营、电商内容团队,以及需要批量生产商品短视频的人。
我试下来最大的感受是,以前每次生成视频,最耗时间的不是AI生成那一步,而是反复确认素材角色、调整顺序、试提示词。这套流程把这些前期的判断逻辑固定下来,换商品的时候只改变量,不用重推整套逻辑。
不过先说清楚,它不是万能的。有明确的限制条件,后面我会专门写一节注意事项,想用的话先看完。
素材准备
用之前先按角色把素材分好类,一个文件夹搞定:
- **参考视频**:一段跳舞视频,负责提供动作和节奏。我用的是一条13秒的竖屏舞蹈。
- **模特图**:一张正面全身模特图,锁定人物的脸、发型、体态和整体气质。
- **场景图**:一张环境图,决定人物在什么地方跳舞。白底图最省事,但场景图给AI一个明确的参考,出来的视频氛围会好很多。
- **服装图**:6张服装图按序号排好,服装1到服装6对应最终视频里换装的顺序。以后想加衣服,加到10套15套也走同样的流程。

Skill调用流程
素材准备好之后,第一步就是输入调用指令。Skill收到指令后会自动索要参考视频。
这一环节它先不生成任何东西,而是先搞清楚要处理的素材是什么。它会检查四类输入:
1. 参考的舞蹈视频,用来解析动作、节奏和每个动作对应的时间点。 2. 模特图,锁定人物长相、体型和气质。这块有个细节,模特图的姿势不会被复制到生成结果里,主要是借人物特征。 3. 6张服装图,严格按照服装1到服装6的顺序,分别生成6张模特换装图。 4. 场景图,作为最终视频里人物活动环境的重要参考。

素材映射与检查
素材确认完毕后,Skill不会马上生成图片,而是先把一份完整的映射条件列出来,让你逐项确认:哪个文件是参考视频,哪张是场景图,服装1到服装6分别对应哪张换装图,最终视频里的图片顺序怎么排。
这一步是整套流程里最容易出错的地方。我做了3年AI内容,几乎所有翻车的换装视频,问题都不是出在模型能力不够,而是素材角色在生成前就已经乱了:衣服顺序排反了、场景图当成了模特图、某个文件重复用了。基础错了,后面动作解析得再准也没用。
确认完映射关系后,Skill会开始拆解参考视频的动作时间节点。比如13秒的视频,前两秒双手举起掌心向前在脸颊两侧摆动,第2到3秒左手叉腰右手向前伸出手指并拢,每个时间段都做标记。动作和时间先明确,后面的服装切换才有对照节奏。

接下来进入换装图生成环节。同一张模特图分别和6张服装图配对,生成6张单人正面全身、统一白底的换装结果图。生成完不算结束,Skill还会自动检查这6张图是不是同一个人、服装顺序有没有错、衣服有没有串款、有没有出现多人或明显裁切、服装结构有没有变化。
6张图全部确认通过,才允许进入最终视频生成。这一步没法跳过,因为在图片阶段发现问题,比进到视频阶段再返工省太多算力了。
我自己有一次就是偷懒,觉得某张图差不多能用就直接进视频,结果生成完发现服装串线,白白多花了几次生成成本。

最终视频生成
换装图确认通过后,Skill会把参考舞蹈视频、场景图、6张换装图、动作时间节点按固定槽位送入最终的视频节点。这次我们锁定的参数是竖屏9比16,时长13秒,分辨率720P,固定正面机位,不加转场效果,也不要背景音乐。
把最终视频提示词复制到生成视频的平台,用自己熟悉的就行。操作上是打开无限画布,新建一个画布,把参考视频、场景图、模特图、6张换装图手动拖进去,然后开始连线:参考视频连到第一张图,然后是第二张、第三张,一直到第六张换装图。把提示词粘贴过来,确认视频1的图片1是场景图,模特在这个场景里跳舞,剩余图片按顺序排列,画布上可以随便拖动调整顺序。


顺序调整好后,点确认生成,就是开头看到的那条效果视频。

成果与复用
跑完整个Skill,你拿到的是一整套交付件,不只是视频本身:
- 6张已按顺序生成的换装图
- 动作时间节点
- 完整的素材映射清单
- 换装提示词
- 最终视频提示词和参数设置
- 最终成片
- 所有能直接打开的成果文件

这套流程能复用的价值在换一批服装、换一个模特或者换一个场景时真正体现出来。你不需要重新摸索整条生产链路,只要按照同样的素材结构替换对应的文件,直接往下跑就行。
我在给朋友试的时候,拿的是他上架的一批新衣服,我换了服装图、保留原模特和场景,整个流程走下来,产出稳定性和第一次用一致,没有出现人物漂移或者服装错乱的问题。
注意事项
这套Skill有两个硬性条件,不满足就根本跑不通:
1. 6张换装过程图必须全部生成并通过确认,不能跳过。 这一步是防止带病素材进入最终视频的关键。你想省时间跳过它,后面视频出错再返工,花的时间只会更多。 2. 服装必须是正常的外穿成衣。 任何触发审核的不合规服装都进不了流程。别抱侥幸心理,这个限制卡得很死。
另外说实话,它也有不稳定的一面。虽然Skill把流程固定了,但AI生成这件事本身还是有随机性,偶尔出现某张换装图衣服细节偏差,需要重新生成一两次。这是所有AI视频工具共同的特性,不是这套Skill独有的问题。
总结
这套流程解决的是服装电商内容生产里的几个典型痛点:素材容易混乱、提示词难以复用、人物和服装不稳定、批量生产时反复返工、新人不知道怎么开始。它把一个容易出错的生成过程,变成了按步检查、逐项确认的标准化流程。
我朋友用了两周,把店里十几套新款都跑了出来,整体效率确实提上来了。他之前最大的感受就是“每次做都是临时拼凑,下次换了商品还得从头开始”,现在不用了。
如果你也在做服装类的AI视频,用手头的素材试一次,一套流程跑完你就能体会,原来换装视频可以按流程走,不用每次靠运气。
视频教程下载
文章可能无法完整分享清楚,下面是原项目视频教程,粉丝朋友可以自行下载学习。提前说明:资源链接内可能会存在引流广告信息,请自行甄别。
百度网盘:
