AI 出图别先写分镜
先说一个反常识
很多人用 AI 做视频、课件、海报脚本,一上来就写“第 1 镜、第 2 镜、第 3 镜”。看起来很专业,结果出图越做越乱:人物一会儿站左边,一会儿跑右边;前一张是教室,后一张变成会议室;本来想讲方法,最后变成堆氛围图。
问题不一定是 AI 不听话,而是你把“故事板”和“分镜板”混成了一件事。
故事板解决的是:这段内容到底怎么讲。分镜板解决的是:这段内容到底怎么拍。前者管逻辑,后者管镜头。顺序反了,就会反复返工。
故事板先管“讲清楚”
故事板不要急着写镜头语言。它更像一张内容路线图,先回答四个问题:
- 这一段让用户看完明白什么?
- 先抛什么问题,后给什么答案?
- 哪个地方需要情绪,哪个地方需要证据?
- 每一幕之间的因果关系是什么?
比如做一个“公考面试答题结构”的短视频,故事板可以是:
开场:考生答题卡壳,暴露问题。
转折:老师指出不是没话说,而是没结构。
方法:给出“观点、原因、做法”的三段式。
示范:同一道题用结构重答一次。
收束:提醒用户先练框架,再练金句。
这一步不要求画面好看,只要求逻辑稳。哪怕用文字、便签、表格都行。对教育内容尤其重要,因为用户不是来看美图的,是来降低理解成本的。
分镜板再管“拍出来”
故事顺了,再进入分镜板。分镜板要具体到画面,不再讨论“讲什么”,而是讨论“怎么让人看见”。
每个镜头至少写清五件事:
画面主体:谁在画面里,做什么。
景别:远景、中景、近景,还是特写。
视角:平视、俯视、侧面、主观视角。
动作:人物、镜头、字幕或道具怎么变化。
连续性:上一镜和下一镜如何接上。
还是刚才那个例子,分镜可以这样写:
镜头 1:中景,考生坐在桌前停顿,答题纸空白,表情紧张。
镜头 2:近景,老师用笔圈出“没有结构”四个字。
镜头 3:俯拍,纸上出现三层框架:观点、原因、做法。
镜头 4:左右对比画面,左边散乱表达,右边结构化表达。
镜头 5:特写,用户在练习本上写下答题框架。
到了这一步再喂给 AI,模型更容易稳定。因为它不是在帮你猜故事,而是在执行画面任务。
一个可落地的 AI 流程
普通人可以按这个顺序做:
第一步,写一句话目标:这条内容让用户获得什么具体收益。
第二步,做故事板:控制在 5 到 7 幕,每一幕只写“信息功能”,比如抛问题、解释、举例、对比、行动。
第三步,检查断点:每一幕之间能不能用“所以、但是、因此”连起来。连不起来,就不是镜头问题,是逻辑问题。
第四步,转成分镜板:给每一幕补景别、主体、动作、环境和连续性。
第五步,再写 AI 出图 Prompt:一张图只服务一个镜头,不要把剧情、情绪、构图、字幕全塞在同一句里。
第六步,批量生成前先做 2 张测试图:先验证人物风格、空间设定和画面质感,再扩展整组。
最容易踩的坑
第一个坑,是把故事板写得太像小说。AI 不怕你写长,怕你没有画面边界。故事板可以抽象,分镜板必须具体。
第二个坑,是每张图都追求惊艳。内容型视频最重要的是连续理解,不是每一帧都像电影海报。教育、知识、运营类内容尤其要克制。
第三个坑,是没有统一“角色和场景设定”。同一个老师、同一个学生、同一间教室,要在分镜板前先定下来,否则 AI 会自由发挥。
第四个坑,是边出图边改逻辑。只要逻辑没定,后面所有视觉资产都可能报废。
我的判断
AI 绘图真正提效的地方,不是让不会画画的人突然变成导演,而是把导演流程拆得更清楚。
先用故事板减少认知返工,再用分镜板减少画面返工。对内容从业者和教育从业者来说,这套方法比“神级 Prompt 模板”更重要。模板只能救一张图,流程才能救一整条内容。