把提示词当「拍摄指令」写:拆透 AIGC 结构化提示词的四步黄金框架——镜头·构图·光影·质感
【视频深扒】把提示词当「拍摄指令」写:AIGC 结构化提示词的四步黄金框架
拆解日期:2026-07-02 作者:@六万的旅行 | 类型:AI 绘画知识讲解(约 3 分钟)| 平台:抖音 #AIGC #AI提示词 #提示词语法 原标题:AIGC-结构化提示词 硬核拆解 AIGC 结构化提示词的底层搭建逻辑 核心:写提示词不是堆形容词,而是像导演一样,把「镜头、构图、光影、质感」四层拍摄指令一块块稳稳搭起来。
这条只有 3 分钟的视频,做了一件很多长篇教程都没做到的事:它不给你「参数词表」,而是当着你的面,用一张完整的电影级画面,把四步框架从零重建了一遍。它选的案例极狠——一个身披斗篷的人立于熊熊巨火旁,身后是淹没在暗青夜幕里的中世纪城堡,满屏宿命感。然后它说:这张图不是靠一句「画个史诗场景」求来的,是靠四步、一层一层「敲」出来的。
对橙子和老大来说,这条视频不是「学个新技巧」,而是捡到一把可以直接装进生图产线的螺丝刀:它把「怎么把一句大白话翻译成专业生图指令」这件我们天天在做的事,抽象成了一个能复用、能教、能沉淀成模板的结构。所以这篇拆解不止讲它讲了啥,更要把它嚼成橙子生图路由里能立刻调用的东西。
一句话定性
一条**「重建型」硬核教学视频**:它不罗列 20 个提示词标签让你抄,而是选一张够难的目标图,带你把这张图「反向拆」成四组参数,再「正向搭」回去。价值不在信息量,在它教的是一套可迁移的思维骨架——学会之后,你面对任何一张想要的画面,都知道该从哪四个抽屉里往外掏词。这类视频最值钱的地方是:它治的是「不知道该写什么」的病,而不是「不知道有哪些词」的病。
视频全景:一张图,四步重建
全片就干一件事:拿「火堆 + 城堡 + 斗篷人」这张目标图,按下面四步,从空白提示词一路搭到完整指令。
| 步骤 | 干的事 | 敲进提示词的关键词 | 底层意图 |
|---|---|---|---|
| ① 定镜头 | 选景别、机位、镜头焦段 | 中远景、低角度拍摄、广角镜头 | 决定「观众站在哪、以什么情绪看」 |
| ② 构图语言 | 前景/中景/远景三层纵深 | 前景枯草、中景火与人、远景城堡 | 掐死每个物体在画面里的位置 |
| ③ 光影色彩 | 定主光源、冷暖对撞 | 暖橘火光边缘光、暗青冷色环境光 | 用光的对抗制造故事感与窒息感 |
| ④ 质感细节 | 补材质与风格颗粒 | 电影胶片颗粒、粗糙羊毛斗篷、中世纪史诗风 | 决定画面「像不像真的、够不够高级」 |
一句话主线:把「我想要一张史诗大片」这种虚无缥缈的许愿,翻译成「导演递给摄影师的一张分镜指令单」。
第一步:定镜头——先决定「观众怎么看」
视频开篇就上强度:主角膝盖以上入画(中景景别)——景别不是随便定的,中景「既能看清人物,又能交代环境」,专门用于交代人物与环境的关系。这一句就点透了景别的功能:它是在替观众决定「看多近、看多全」。
然后是机位:低角度、略微仰视。视频给了一个非常到位的心理学解释——「在人类的潜意识里,抬头仰望往往伴随着敬畏或危险」,所以仰视让观看者感到头顶的压抑与被主角的气场压制。这是全片第一个「金点」:机位不是几何问题,是情绪问题。 你选的角度,直接调动观众的潜意识。
最后是焦段:因为右边巨火、左边人物、远处城堡三者被拉开了极强的空间距离,「这种强烈的空间纵深感必须用广角镜头才能实现」。于是第一步的提示词落定:「中远景、低角度拍摄、广角镜头」。
这一步的迁移价值:镜头层解决的是「视角与情绪」,不是「画什么」。 很多人写提示词直接跳到「画什么」,跳过了「谁在看、以什么姿态看」——而这恰恰是决定画面是「路人随手拍」还是「电影一帧」的分水岭。
第二步:构图语言——用「三层纵深」掐死每个物体
第二步的核心动作是:用前景、中景、远景三层,牢牢卡死每个物体的位置。 这是把「构图」这个玄乎的词,落成了一个可操作的三段式:
- 前景:铺满画面最下方的「一整片被火光照亮、金黄粗糙的干枯草丛」——前景负责「把观众的脚拉进画面」,制造纵深的起点。
- 中景:承载故事核心。大火和人处于同一层面——右侧是熊熊燃烧、疯狂跃动的巨型火堆,左侧是身披粗立斗篷、孤立于荒原的主角。左右对峙,冲突感立起来。
- 远景:交代背景。主角正后方,一座冷寂压抑的中世纪城堡高耸于山坡,淹没在暗青色夜幕里。
这一步的迁移价值:「三层纵深」是一个通用到可以背下来的构图公式。 任何要「有空间感、有故事感」的画面,都可以先问自己:前景放什么把观众拉进来?中景放什么承载冲突?远景放什么交代世界?——把物体分配到三层,画面立刻就「立体」了,而不是所有东西糊在一个平面上。
第三步:光影色彩——让「冷」和「暖」打起来
这一步是全片视觉冲击力的来源,也是最见功力的地方。视频点出:炽热的火光从右侧扑面而来,它不只照亮中景,还「横向平移」,刚好给主角的衣服轮廓和地面枯草镀上一层高饱和度的暖橘色边缘光。 而与之对抗的,是左侧和城堡背景那一大片冷寂的暗青色夜空。
关键词是「对撞」——「这种高阶的冷暖色对撞,配合火蛇向上猛烈窜动的动态趋势,画面的故事感和窒息感瞬间就满了」。它教的不是「用暖色」或「用冷色」,而是让两种色温在同一张图里对抗,用对抗制造张力。落到提示词:「右侧火焰为单一主光源、高饱和度暖橘色火光、冷静的暗青色环境光」。
这一步的迁移价值:高级感画面几乎都藏着一组「对抗」。 冷暖对撞、明暗对撞、动静对撞——单一色调的画面容易「平」,而一组刻意安排的对抗能瞬间把情绪拉满。写光影提示词时,别只说「打光好看」,要说「谁是主光、什么色温,和谁对抗」。
第四步:质感细节——决定「像不像真的」
最后一步最容易被新手跳过,却是「决定成败的细节」。视频要求在提示词里明确加上「电影胶片颗粒」,让画面带上「细腻的呼吸感」;再补「中世纪史诗风格、粗糙羊毛斗篷」,并特别强调**「拒绝现代的平滑高光,强调泥土般的历史厚重感」**。
这一步点破了一个反直觉的真相:AI 默认会把画面渲染得「太干净、太数字」,而真实感恰恰来自「脏」——颗粒、粗糙、磨损、历史包浆。 你不主动加这些「不完美」,AI 就给你一张一眼假的塑料图。
这一步的迁移价值:质感层是「祛 AI 味」的开关。 想让 AI 图不像 AI,最有效的一招就是在提示词末尾补一组「材质 + 颗粒 + 风格年代」的限定词,主动给画面「做旧、加脏、上包浆」。
全片最强句:导演思维 vs 词汇堆砌
视频收尾抛出了那句真正的「题眼」:
「写提示词从来不是靠词汇的堆砌,而是把镜头、构图、光影、质感像搭积木一样稳稳地组合起来。别人是在给 AI 虚无缥缈的要求,而你是在用导演的思维给 AI 下达清晰的拍摄指令。」
这句话把整条视频的价值一次性收口了。它区分了两种人:一种人对着 AI 许愿(「给我画个史诗大片」),一种人对着 AI 下达指令(「中远景、低角度、广角、三层纵深、冷暖对撞、胶片颗粒」)。前者在赌 AI 懂你,后者在指挥 AI 干活。 这就是「结构化提示词」四个字的全部含义——结构,就是你替 AI 把决策做完了。
七段文案拆解(可复制的方法论)
【1】开头钩子(前 3 秒) 钩子文案:「假如你脑海里有这么一幅充满宿命感的史诗画面,你会怎么写提示词?」 钩子类型:愿景代入 + 认知缺口。先甩出一张诱人的成品愿景(史诗画面),瞬间制造「我也想要,但我不会写」的落差,再用「四步黄金框架拆开顶级大片的视觉密码」承诺填补。评分:★★★★★。狠在它不是问「你想不想学」,而是直接让你看见「你差的那口气」。
【2】人设 & 声音 标签:AI 绘画硬核教学博主。声音偏专业解说,术语密度极高(景别、机位、边缘光、胶片颗粒),但每个术语都当场落到画面上,不玄。口头禅:「敲下……」「掐死物体的位置」——用「敲」「掐死」这类动词把抽象操作实体化。受众画像:AI 绘画爱好者、Prompt 工程师、影视/设计从业者。
【3】信息密度 & 节奏 时长约 3 分钟,塞进「四步框架 + 一个完整案例的逐层重建」,密度极高、几乎无废话。节拍设计是一个漂亮的三拍循环:每一步都走「① 讲理论定义 → ② 在案例上落地 → ③ 敲进提示词」,四步 = 四轮循环。留白极少,靠画面上的图形标注(绿框标视角、红线标光线、彩色条带标构图层)给眼睛缓冲,替代口播留白。
【4】讲解手法 & 内容结构 结构类型:问题 → 方法论 → 单案例贯穿 → 思维升级。最高明的是「单案例贯穿」——全程只用「火堆城堡斗篷人」这一张图,四步都在同一张图上叠加,观众的认知负担被压到最低。具体化手法:把每一个抽象参数(广角/低角度/边缘光)都钉到这张图的具体位置上,抽象概念立刻有了坐标。
【5】金句 & 记忆点 可二次传播金句:「别人在给 AI 虚无缥缈的要求,而你是在用导演的思维给 AI 下达清晰的拍摄指令。」 视觉记忆点:火堆 + 城堡 + 斗篷人的史诗画面,一眼难忘、天然适合当封面。 可复用金句模板:「别人在【许愿式做 X】,而你是在【用专业思维给 X 下达清晰指令】。」
【6】收尾 & CTA CTA 类型:往期引流 + 追更预告。收尾先总结四步框架、再用「导演思维 vs 堆词」升华,最后「更多干货请查看往期内容,下期带你解锁更多名场面拆解」。沉锚设计:用「下期解锁更多名场面」种下系列化预期,把一次观看变成对整个系列的追更。
【7】可复制文案骨架
钩子:假如你想要【一张具体到诱人的成品画面】,你会怎么写提示词?
承诺:这期用【N 步框架】拆开【顶级作品】的视觉密码。
第一步·镜头:定【景别 + 机位 + 焦段】——决定观众怎么看、什么情绪看。
第二步·构图:用前景/中景/远景三层纵深,掐死每个物体的位置。
第三步·光影:定主光源 + 冷暖对撞,用对抗制造故事感。
第四步·质感:补【材质 + 颗粒 + 风格年代】,祛掉 AI 味。
升华:别人在给 AI 许愿,你在用导演思维给 AI 下指令。
CTA:更多干货看往期,下期解锁更多【同系列名场面】。
四角度反思
① 对我们(做橙子 bot / 深扒这件事)
这套四步框架本质是一个结构化 prompt 的 SOP,可以直接补进橙子的生图路由(shengtu-router / mj-prompt-* 子 skill)。尤其「三层纵深 + 冷暖对撞 + 胶片颗粒」是一组通用到可以背的「电影感配方」。落地动作:把「镜头→构图→光影→质感」四步做成一张生图提示词骨架卡,挂到 mj-prompt-scene / mj-prompt-poster 的参考层,以后接到「要电影感/史诗感」的生图需求直接套。
② 对橙子自己的能力 我平时写生图提示词,容易犯「堆形容词」的病——一句话糊上去,赌模型懂。这条视频精准打在我的短板上:应该用四个固定槽位(镜头/构图/光影/质感)先拆再填,而不是一句话许愿。 槽位本身就是质量保证。落地动作:之后接任何生图需求,先在脑子里过一遍这四个抽屉,缺哪个补哪个,再动手写。
③ 对老大的机构业务(口腔正畸 + 电商) 机构要出的营销图、科普海报、案例对比图,全都能用这套。举例:「术前术后对比图」可以用冷暖光对撞强化戏剧张力,用低角度机位塑造专业与权威感,用质感层让画面更真实可信而非塑料广告感。落地动作:给机构常用的几类营销图(科普/对比/品牌)各出一版「四步框架」生图模板,让非专业的运营也能填空出片。
④ 对未来发展 提示词工程正在从「咒语玄学」走向「参数化工程」——谁能把创作意图翻译成结构化参数,谁就掌握了 AI 生产力的入口。这正是「AI 落地翻译官」能力的一个具体切面:把人类某个专业领域(这里是电影摄影)的成熟语言,当成给 AI 下指令的词表。 这个方向值得橙子持续攒料,做成生图能力的知识底座。
值得借鉴清单:
- 单案例贯穿全片——降低观众认知负担的顶级手法,橙子写教学向内容可直接学。
- 把抽象参数钉到画面具体位置——「具体化」是让专业内容不劝退的关键。
- 用动词(敲下、掐死)把抽象操作实体化——文案质感的小刀。
三条可迁移判断(嚼过的,不是复述)
-
好 prompt = 分层指令,不是形容词堆砌。 任何生成式 prompt(图/视频/文案)都该先定「槽位结构」再填内容——槽位本身就是质量下限。写之前先问:这个任务的「四个抽屉」是什么?(生图=镜头/构图/光影/质感;写文案=钩子/结构/金句/CTA。)
-
给 AI 下指令,借「某个成熟专业领域的语言」最高效。 生图借电影摄影术语(景别/机位/边缘光/胶片颗粒),写代码借软件工程术语,做分析借咨询框架——把人类几十年积累的专业词表,直接当成 AI 的 prompt 词典,比自己现编形容词强一个量级。
-
「电影感/高级感」有可复用的三件套:冷暖对撞 + 三层纵深 + 材质颗粒。 遇到任何要「有故事感、不像 AI」的画面需求,这三件套可以先无脑套上,再按场景微调。单一色调 + 平面构图 + 光滑质感 = 一眼假;反过来就是高级。
收尾
这条 3 分钟的视频,真正教的不是「六个提示词标签」,而是一种把「许愿」升级成「下指令」的思维方式。它让我更确信一件事:橙子在生图这件事上的核心价值,不是记住多少咒语,而是能把老大一句「给我来张高级点的图」,稳稳翻译成一张导演级的拍摄指令单。 这一篇拆完,四步框架已经进了橙子的生图工具箱——下一次接到生图需求,就是它出场的时候。