高能量穿搭转场特效怎么做——拆解六叔 ultra 的 AI 换装教程(附完整提示词)

原视频:六叔ultra · 教程来啦,高能量穿搭转场特效🔥

作者:六叔ultra|时长:约 57 秒|类型:AI 工具教程(可复制) 标签:#ai视频换装 #image2 #seedance|拆解材料:逐字稿(口播全文)+ 逐帧画面分析(屏幕操作 + 两段完整提示词截屏)


一句话定性

这不是一条「炫效果」的展示视频,而是一份把最近很火的「AI 换装转场」做成了傻瓜两步、且把两段提示词原文都摆出来的可复制教程

它真正值钱的不是那段丝滑换装的视频,而是这套**「一张人像照 → 多张穿搭海报图 → 一条换装 Lookbook 视频」的固定流水线**:模特只拍一次、风格随便换、转场交给模型,普通人照着提示词填空就能复刻。看懂它,等于拿到一个**「人物一致 + 风格批量」的 AI 视频生产模板**。

本文按博客抖音专栏的深度来拆:先给一步步能照做的操作步骤两段完整提示词(教程的命门),再按 7 段结构拆它「为什么这么讲才有人学得会」,最后给老大可迁移的启发。


先说清楚:它到底做出了个什么效果

一个固定的人(六叔本人的形象),在一条视频里连续换 6 套穿搭——正式、运动、休闲、户外、潮流、居家——每套之间是丝滑转场而不是硬切,背景干净、镜头稳定,整体像时装店的 Lookbook 大片。

关键点有三个,决定了它能「稳定出片」:

  • 人不变、衣服变:6 套造型里始终是同一张脸、同一个身材气质,靠的是提示词里反复强调的「人物一致性」。
  • 图先成型、再动起来:不是直接文字生成视频,而是先用图像模型把每套穿搭做成带版式的海报图,再把这些图喂给视频模型做「图生视频」。图可控,视频才可控。
  • 换装顺序是手动指定的:转场的先后由提示词里一句「图片 2 → 图片 4 → 图片 6 …」精确控制,不是让模型随机排。

【可复制操作步骤】一步步照做(教程命门)

整条链路就两大步,作者原话「就两个步骤」。下面拆到「点哪个、填什么、勾什么」的颗粒度。

Step 0 · 准备(一次性)

  • 准备 1 张清晰的本人正脸/半身照作为模特底图(决定最后视频里的「人」)。
  • 用一个画布式 AI 创作工具:界面是「左边画布 + 右边对话」,顶部能选模型,模型偏好分 Image / Video / 3D 三个标签页(图像可选 GPT Image 2、Nano Banana Pro 等;视频可选 Seedance 2.0)。本教程演示的就是这类多模型创作画布。

Step 1 · 用 GPT Image 2 生成「穿搭海报图」

  1. 选图像模型:模型偏好 → Image 标签页 → 选 GPT Image 2(作者强调「一定要使用 img2 的模型」;Medium/High 都行,High 细节更足、更贵)。
  2. 上传那张模特照片作为参考。
  3. 贴入下方【完整提示词 1】,只改一个地方——把「穿搭风格」那一栏填成你要的风格(休闲 / 正式 / 运动 / 户外 / 潮流 / 居家……)。
  4. 点生成。模型会产出一张左右分栏的穿搭海报:右侧是穿着该风格的全身模特,左侧把这套的「配饰 / 上衣 / 下装&鞋履」平铺拆解,顶部带「XX 穿搭」大标题。成品是 1152×2048 竖版
  5. 换风格重复 5~6 次,得到一组同一个人、不同风格的穿搭海报(视频里用了 6 张)。

这一步的核心是「人物锁定 + 版式锁定」:提示词把脸、发型、身材按死,又把版式按死成「左拆解、右模特」,所以每张图风格不同但长得是同一个人、排版是同一套模子——这正是后面能拼成连贯视频的前提。

Step 2 · 用 Seedance 2.0 把这组图做成「换装视频」

  1. 切到视频模型:选 Seedance 2.0(标注「会员专属」,另有 Seedance 2.0 Fast)。
  2. 先过「人物审核」:把这些穿搭图上传到模型素材库,系统提示「角色素材需通过素材库审核后方可使用」——必须等审核通过,含人物的素材才能拿来生成。这一步新手最容易卡。
  3. 选中要参与换装的几张图作为素材(在素材库里勾选 → 应用)。
  4. 贴入【完整提示词 2】:里面要显式写死换装顺序(如「图片 2 → 图片 4 → 图片 6 → 图片 5 → 图片 1 → 图片 3」),并描述「高级时装 Lookbook、干净背景、稳定镜头、流畅转场」。
  5. 设视频参数(作者原话「分辨率、时间、音频勾上」):
    • 画面比例:21:9(宽屏 Lookbook 感)
    • 分辨率:720p(也可 480p / 1080p)
    • 时长:10s(4s~15s 可选)
    • 音频:开
    • 网络搜索:关
  6. 再检查一遍图片、确认顺序无误,点击生成。作者原话:「基本上就是一把直接出,效果很稳定。」

为什么这步要先「审核」再「指定顺序」?因为视频模型把每张图当成一个「关键帧」,顺序就是转场的剧本;而平台对「含真人/人物形象」的素材有合规审核门槛,不过审根本喂不进去。顺序 = 节奏,审核 = 入场券,两者缺一不可。


【完整提示词】可直接复制(教程最该截图的部分)

以下两段为视频中逐字展示的提示词原文(六叔标注「附完整提示词」「大家直接截图」)。已按屏幕原文整理,方括号 [ ] 是需要你替换的变量。

完整提示词 1 · 男士穿搭海报提示词(喂给 GPT Image 2)

用法标注:只上传模特图 + 指定风格 | 固定版式 | 左侧单品拆解 + 右侧全身模特

【核心提示词】
基于上传的模特照片,生成一张男士穿搭展示海报。
请严格保留上传图片中模特的脸部特征、发型、身材比例、年龄气质和人物身份一致,
不要更换人物,不要改变五官,不要改变发型。只根据指定穿搭风格,为模特重新
设计一套完整穿搭,并生成对应的海报展示。
穿搭风格:[在此填写风格,例如:休闲、正式、运动、职场、复古、户外、潮流]等
画面比例为竖版 3:4,背景为干净的米白色或浅灰白色,整体风格高级、简洁、
时装杂志 Lookbook 质感。

【一致性要求】
左侧展示的所有拆解单品,必须与右侧模特身上的穿搭完全对应。
保持颜色、款式、版型、材质、图案、配饰、鞋子和整体的搭配关系。
不要出现左侧单品和右侧模特穿搭不一致的情况。

【画面质感】
真实摄影质感,高级穿搭海报风格。
柔和自然光线,服装细节清晰,布料材质真实。
整体色调要干净、精致、有留白,有电商 Lookbook 和时装穿搭海报的感觉。

【禁止项】
不要生成或混入无关真人照片。
不要只展示模特而没有左侧单品拆解区。
不要改变左右分栏结构。
不要出现多个模特。
不要裁切模特身体。
不要使用复杂背景。
不要让文字乱码。
不要让单品展示区杂乱。
不要让左侧单品和右侧模特穿搭不一致。

【固定版式要求】
画面采用左右分栏结构。
· 右侧为模特展示区,占画面宽度约 45%。模特完整站立在画面右侧,从头到脚
  全身展示,面部不要被裁切。模特面向镜头、身体微侧,可双手插兜、自然垂放,
  或手部做出符合穿搭风格的轻松动作。入镜高度约占画面高度 75%~85%,整体视觉居中。
· 左侧为服饰单品拆解区,占画面宽度约 55%,从上到下分为四个部分:
  第一部分 · 标题标语区:左上角放一个醒目的中文大标题,按穿搭风格自动生成
    (如"休闲穿搭""正式穿搭""运动穿搭""职场穿搭")。字体大,含中英文主副标题,
    颜色深黑/黑灰/深灰;标题下方可加 emoji、小图标等简洁装饰。
  第二部分 · 配饰区(配饰 / ACCESSORIES):展示 2-4 件与穿搭一致的配饰
    (包、腰带、眼镜、帽子、手表、项链等),平铺商品摄影方式,排列整齐干净。
  第三部分 · 上衣区(上衣 / TOP):展示身上的上衣单品(外套、衬衫、T恤、
    卫衣、针织衫等),1-3 件,必须与右侧模特一致。
  第四部分 · 下装 & 鞋履区(下装 & 鞋履 / BOTTOM & SHOES):展示裤子/下装
    与鞋子,商品摆拍方式,置于左侧下半部分,清晰完整,不重叠遮挡。

完整提示词 2 · 换装视频提示词(喂给 Seedance 2.0)

(前置:角色素材需通过素材库审核后方可使用)

换装顺序严格按照:图片 2 → 图片 4 → 图片 6 → 图片 5 → 图片 1 → 图片 3。

整体风格为高级时装 Lookbook 视频,干净背景,稳定镜头,流畅转场,
真实布料质感,动态展示自然,画面精致专业。

两段提示词的分工:第一段管「单张图长什么样 + 人是同一个」,第二段管「多张图怎么连起来动」。新手只要保住第一段的人物一致性、改对第二段的图片顺序,基本就能复刻。


7 段拆解 · 它为什么能让人「看一遍就学会」

【1】开头钩子(前 3 秒)

  • 钩子类型:悬念问句 + 效果前置的复合钩子。
  • 原文:「你是不是也想知道,像这种换装的视频,用 AI 怎么去生成?马上给你们安排教程,先看看六叔复刻的效果。」
  • 它怎么做的:先用一个问句把「我也想做」的人钉住,紧接着不废话、直接甩成品换装效果,用结果证明「这条值得看完」。

拆原理:教程类视频的最大敌人是「我学不会 / 太麻烦」的预判劝退。它用「先放结果」对冲这种预判——你先被效果勾住,才有耐心听步骤。这是教程区的通用开法:先证明能做到,再讲怎么做到,顺序反了完播率就崩。

  • 评分:★★★★☆(效果前置很抓人;问句略套路,但被「最近很火」的话题红利补足了)

【2】人设 & 声音

  • 人设标签:AI 技能博主 / 工具拆解型。口头落点是「关注六叔,持续丰富你的 AI 技能库」。
  • 说话风格:节奏快、指令清楚、不抒情,全程「第一步…第二步…」的工具人口吻,听感像同事手把手带你过一遍。
  • 画面人设:本人小窗真人出镜 + 屏幕录制为主,真人小窗负责「信任背书」,屏幕负责「证据」。

拆原理:教程博主的信任来自「他真的在操作」。真人小窗 + 实屏录制的组合,等于一边告诉你「这是活人不是搬运」,一边把每一步摊在你眼前,可证伪 = 可信。这跟带货博主靠「闺蜜关系感」建信任是两条路,但底层都是降低观众的防御。

  • 精准受众画像:想做 AI 短视频/换装内容但不懂工具链的创作者、矩阵号运营、想蹭「AI 换装」热点的素人。

【3】信息密度 & 节奏

  • 总时长:约 57 秒;信息密度:很高(一条完整工具链塞进不到一分钟,几乎没有废话)。
  • 节奏设计(前快后稳):
    • 0–10s:抛问题 + 甩效果(,先勾住)。
    • 10–30s:第一步全过程——选 img2、贴提示词、生成海报图(放慢,逐步演示)。
    • 30–50s:第二步全过程——Seedance、人物审核、贴视频提示词、设参数(最慢、最密,这里是命门)。
    • 50–57s:成片效果 + 关注引导(收尾提速)。

拆原理:教程的节奏不是匀速,而是**「钩子快、操作慢、收尾快」**。最该慢的是「别人最容易卡」的地方(选模型、贴提示词、过审核、设参数),这里每一步都给了特写和字幕。把时间花在观众会卡壳的步骤上,是教程能不能「学得会」的关键,也是它和「只炫效果」视频的根本区别。

【4】讲解手法 & 内容结构

  • 内容结构:教科书级的**「效果 → 两步分解 → 单步细化 → 成片验证」**线性结构,零分叉、不跳步。
内容作用为什么有效
效果前置先放换装成片给「值得学」的理由对冲「学不会」的劝退
框架定调「就两个步骤」降低畏难感把复杂链路压成「只有 2 步」
第一步细化img2 + 提示词 + 出海报图给可复制动作提示词原文上屏,可截图照抄
第二步细化Seedance + 审核 + 顺序 + 参数给关键参数把易卡点逐个特写
成片验证「一把直接出、很稳定」打消「翻车」顾虑用结果兜底可信度
  • 最值得学的手法 ——「把复杂说成两步」:整条链路其实有选模型、写提示词、传素材、过审核、设参数、排顺序等近十个动作,但作者对外只喊「两个步骤」。这是教程的「心理减负」:先让你觉得「就两步、我能行」,再在每步里慢慢喂细节。

拆原理:人对「步骤数」极其敏感,「十步」会劝退、「两步」会上手。把动作按”大步骤”归并、把细节藏进大步骤内部,既不丢信息、又不吓跑人。这套「对外报两步、对内给十步」的讲法,是所有好教程的共性。

  • 可视化教学:每个关键动作都配屏幕特写 + 黄色字幕双保险——选模型时框出「GPT Image 2」、贴提示词时整段提示词卡上屏、设参数时放大「720p / 10s / 音频」。口头说的每一步,画面都给一个证据镜头

【5】金句 & 记忆点

可二次传播 / 可复用的句子:

  1. 就两个步骤」——把复杂工具链一句话减负,最强的「我也能做」暗示。
  2. 一定要使用 img2 的模型」——给一个明确的、排他的指令,消除选择焦虑。
  3. 基本上就是一把直接出,很稳定」——用「稳定」打消翻车顾虑,是教程的临门一脚。
  4. 持续丰富你的 AI 技能库」——把「关注」包装成「给自己攒技能」,软性涨粉。
  • 视觉记忆点:6 套穿搭丝滑换装的成片本身就是最强记忆点;左拆解右模特的海报版式也很有辨识度。

【6】收尾 & CTA

  • CTA 形式关注涨粉型(区别于带货的即时成交)。唯一动作指向「关注六叔」,理由是「持续丰富你的 AI 技能库」。

拆原理:工具教程的目标函数是**「让你期待下一条」**,而不是当场买。所以它把 CTA 包装成「对你有用」——不是「求关注」,而是「关注我=你以后能学到更多技能」。把利益从博主身上转移到观众身上,是涨粉类 CTA 转化率高的根本。

  • 衔接:从成片效果直接滑到关注引导,中间不拖泥带水,57 秒一气呵成。

【7】可复制骨架(操作 + 口播双骨架)

操作骨架(换工具也成立的通用流程):

① 定主体:1 张人像照(锁住"人")
② 图像模型 + [人物一致性提示词] + [风格变量] → 批量出 N 张"同人不同风格"的图
③ 视频模型 + 素材审核 + [显式顺序提示词] + [参数:比例/分辨率/时长/音频] → 出转场视频
④ 检查顺序无误 → 生成 → 一把出片

口播骨架(教程文案填空模板):

你是不是也想知道,[某种很火的效果],用 AI 怎么做?马上安排,先看效果。
就两个步骤。
第一步,[用 X 模型] 配合 [这段提示词],生成 [中间产物]。大家直接截图。
第二步,[用 Y 模型],先 [必要的前置:上传/审核],再配 [这段提示词],
        设好 [关键参数],点击生成。
基本上一把直接出、很稳定。学会了吗?关注我,持续丰富你的 [某领域] 技能库。

一句话:教程的「可复制」是双层的——对观众是「提示词照抄、参数照设」;对博主是「这套讲法换个效果还能再拍一条」。六叔这条本身就是个可复用的教程模板


关键坑 & 注意点(照做时最容易卡的地方)

  1. 图像模型必须选对:作者反复强调用 GPT Image 2(img2)。换成别的图像模型,人物一致性和版式还原会明显变差。
  2. 人物一致性是第一命门:提示词里「不改五官、不改发型、不换人」这几句一个都不能删——删了就会出现「换套衣服换张脸」,整条视频废掉。
  3. 素材必须先过审核:Seedance 这类视频模型对「含人物形象」的素材有合规审核,没通过审核根本选不了。新手常卡在这一步,以为是 bug。
  4. 换装顺序要手动写死:转场顺序由提示词里的「图片 2→4→6…」决定,不写就会乱序或重复。顺序就是转场剧本
  5. 参数别漏「音频」:作者特别点了「音频勾上」,否则成片没声、Lookbook 的氛围感会差一截。
  6. 会员门槛:Seedance 2.0 标注「会员专属」,没开会员可能只能用 Fast 版或受限——动手前先确认账号权限,别白做前半段。
  7. 合规红线:换装内容别碰违规元素,人物形象用自己的、别盗用他人肖像。(此条只作提醒,具体以平台规则为准。)

给老大的可迁移启发

  1. 「先成图、再成片」是当下 AI 视频最稳的范式。直接「文字 → 视频」可控性差、容易翻车;而「文字 → 可控的图 → 图生视频」把不确定性切成两段、各个击破。我们以后做任何 AI 视频(产品演示、群日报动图、IP 形象短片),都该走**「中间产物可控」**这条路,而不是赌一把 end-to-end。

  2. 「人物一致性」这段提示词值得抄进素材库。它把「锁脸、锁发型、锁身材、不换人」写成了可复用的约束块——任何要「同一个人/IP 出现在多张图」的场景(虚拟主播、固定数字人、连载封面)都能直接套。这跟我们做固定数字人带货是同一个底层需求。

  3. 「显式指定顺序/结构」比「让模型自由发挥」可靠得多。它用「图片 2→4→6…」把转场剧本写死。对照我们写 prompt 的教训——该约束的地方就硬约束,把关键决策从模型手里收回到自己手里,产出才稳定可复现。

  4. 「把复杂讲成两步」是内容表达的通用功夫。近十个动作对外只说「两个步骤」,先减负再喂细节。我们写技能介绍、发教程、跟老大汇报,都该学这个——先给一个”就两步/就三件事”的简单框架,再往里填,别一上来堆十个细节吓退人。

  5. 这是一个”可被我们复刻成生产线”的样本。六叔的两步法 = 提示词模板 + 参数清单,高度结构化。我们完全可以把它沉淀成一个内部 skill / worker 流程:输入一张人像 + 一组风格词,自动跑「批量出穿搭海报 → 图生换装视频」。把验证过的他人流程固化成自己的模板,是最快的能力扩张方式。


拆解逻辑:先证明效果(先看成片)→ 给可复制资产(两段提示词原文 + 参数清单)→ 拆它为什么讲得好(7 段)→ 抽出可迁移的范式(先成图再成片 / 人物一致性 / 显式顺序 / 两步减负)。教程的价值不在「看完」,而在「照着做出来」。