先别上来就写视频提示词

很多人做 AI 图生视频,一开始就想:“我要一个很震撼的镜头。”结果越写越复杂,人物一会儿换脸,一会儿换衣服,一会儿像另一个世界的人。

真正省力的做法反过来:先把“这一张图”做稳,再让它动起来。图生视频不是提示词比赛,更像一条小型生产线。图片是模具,视频只是把模具加上动作和运镜。

人物一致性,本质是资产管理

所谓人物一致性,不是每次都祈祷 AI 记住你,而是把人物拆成可复用的资产。

最少要固定 4 件事:脸型和年龄感、发型和服装、标志物、气质关键词。比如“短发、浅色衬衫、黑框眼镜、讲课时冷静克制”,就比“一个专业老师”稳定得多。

内容和教育行业尤其要重视这一点。一个账号里的讲解者、案例人物、课程 IP,如果每条都长得不一样,用户会下意识觉得不专业。稳定的人物形象,会降低理解成本,也会让内容更像一个系列,而不是一堆散片。

四宫格不是炫技,是质检

四宫格的核心价值,不是一次出 4 张图,而是同时检查 4 个维度。

可以这样用:第一格放正面半身,检查脸和气质;第二格放近景表情,检查可识别度;第三格放动作姿态,检查身体和服装是否崩;第四格放真实场景,检查人物能不能融入内容场景。

这一步不要追求“每张都好看”,而是找问题。哪怕只有一张能用,也值得;如果 4 张里人物都不稳定,说明前面的设定还不够硬,别急着进视频。

好图出来后,视频提示词要变短

很多人把视频提示词写成小说,反而容易失控。图已经承担了人物、场景、风格,视频提示词只需要补两个东西:动作和镜头。

建议用这个句式:人物做一个动作,镜头做一个运动,时长保持短。比如“人物抬头看向镜头,轻微点头,镜头缓慢推进”。越是新手,越不要同时要求转身、走路、挥手、表情变化、背景变化。每次只测一个变量,成功率更高。

一条可落地的流程

第一步,写人物卡:固定外貌、服装、身份感和情绪基调。

第二步,出四宫格:正面、近景、动作、场景各一张,先质检一致性。

第三步,选主图:优先选人物清楚、背景干净、动作不夸张的图。

第四步,做短视频:只写动作和运镜,控制在 5 到 8 秒。

第五步,复用资产:把稳定的人物图、提示词、失败原因都存下来,下次不要从零开始。

这套方法的关键判断是:AI 视频效率不在“会不会写神奇提示词”,而在“有没有把前置素材做成稳定资产”。先定人,再定图,最后定动作。普通人想提效,别追求一次生成大片,先追求每次都能稳定产出一条能用的小片段。