跳到主要内容

AI 视频生成术语表:新手必懂的核心词汇

阅读约 4 分钟

作者:Nureta更新于 2026年6月25日

刚接触 AI 视频生成?这是一份速查表,收录了你会反复遇到的几个词。每个术语都配一句不带行话的大白话解释。弄懂之后,让它们真正记住的最好办法就是动手试试——浏览场景目录找现成的灵感,或者打开创作页,把一句话变成视频。

文本生成视频(Text-to-video)

文本生成视频是这类工具的核心思路:你用大白话写一段描述,模型就生成一段与之匹配的短视频。没有摄像机,也没有素材要剪辑——你打的字是输入,动起来的画面是输出。这份清单上的其他术语,全都是你通过这段文字来掌控的东西。

提示词(Prompt)

提示词就是你给模型、用来描述想看到的画面的那段文字。它越具体、越有画面感——画面里有谁、在哪里、光线如何、在做什么——结果就越接近你脑海中的样子。含糊的提示词生成平庸的视频,具体而有感官细节的提示词生成具体的视频。

场景(Scene)

场景是发生在同一地点的一段连续瞬间——单一的环境、一段时间、一个主要动作。比起把好几个瞬间塞进去,让每次生成都停留在一个场景里,AI 视频的效果最好。在本应用里,可浏览的目录条目就叫“场景”——可以挑选并改写的现成起点。

帧(Frame)

帧就是一张静止画面,而视频不过是把许多帧快速连续播放出来。模型生成视频时,会产出一连串前后在视觉上保持一致的帧,让动作看起来流畅。当人们谈起片段里某个特定瞬间,说“一个镜头”或“一张画面”时,指的单位也是帧。

画面比例(Aspect ratio)

画面比例就是视频的形状——宽与高之间的关系。竖屏(9:16)适合手机和社交信息流,横屏(16:9)适合大屏和播放器,方形(1:1)介于两者之间。一开始就选对画面比例,结果就能恰好契合你打算发布的地方,不必再尴尬地裁切。

渲染(Render)

渲染是模型把你的提示词变成可观看、可下载的实际视频文件的那一步。“正在渲染”指的是这件事发生时的短暂等待,而“渲染成品”指的是做好的那段片子本身。要是哪里看着不对,就调整提示词再渲染一次——反复打磨文字,就是整个创作循环。

想试试看?

粘贴故事,看它变成场景 — 登录后第一个视频免费。

开始创作

更多指南