跳到主要内容

怎样写提示词才能生成更好的场景

阅读约 6 分钟

作者:Nureta更新于 2026年6月18日

如果你的 AI 视频总是“接近但不到位”,问题通常出在任何设置的上游——出在场景是怎么写的。模型只能渲染你用文字给到它的东西。这五条规则能把一段平淡的描述,变成模型真正能调度起来的描述。

1. 描述摄像机看到的东西

模型渲染的是画面,所以要用画面来写。把内在状态替换成可见的状态:不要写“他很紧张”,而要写“他敲着桌子,瞥向门口”。每一句都应该是摄像机能捕捉到的东西。

如果一个细节拍不出来,它就不会出现在画面里。把情绪和前情,翻译成姿态、表情、动作和场景。

2. 一次只写一个场景

选定单一地点和单一瞬间。一个想从厨房切到车里、再切到屋顶的场景,等于要模型在一次生成里在三个镜头之间剪辑,结果往往一个都满足不了。

如果你心里有一组连续画面,就一个情节一个情节地生成,再把结果串起来。每个情节都能得到模型的全部注意力。

3. 用感官细节营造氛围

光线、天气、色彩、质感和一天中的时段,承担了电影里大部分的情绪表达,而它们恰恰是文字里最好拨动的杠杆。“黄昏的金色光线穿过一扇满是灰尘的窗”,比“一个不错的房间”能告诉模型多得多的信息。

对动态也要具体——缓慢的、突然的、飘移的、急促的。节奏也是氛围的一部分。

4. 一致地描述人物

如果有人物出场,就给他们稳定、具体的特征——发型、身形、衣着——并且每次他再次出现时都用相同的描述。一组连续画面里的一致性,取决于描述的一致性。

含糊的人物会在多次生成之间漂移走样。具体的人物则能在一个个镜头之间守住自己的身份。

5. 要避开的常见错误

不要堆砌相互矛盾的描述(“一个阳光明媚的午夜”),不要让关键动作被一堆形容词埋没,也不要在一句清晰的话就够用时硬写成一整段。篇幅不等于细节——精准才是。

结果不对时,每次只改一处,再重新生成。调整单独一行、再做对比,正是你弄清每个词在起什么作用的方法。

想试试看?

粘贴故事,看它变成场景 — 登录后第一个视频免费。

开始创作

更多指南