刚接触AI视频生成的朋友,经常会被各种英文术语和技术名词搞晕。什么是"文生视频"?"运动笔刷"又是啥?这篇文章把最常用的术语用大白话讲清楚。
基础概念
- Prompt(提示词):你给AI的文字指令,描述想要什么画面
- Text-to-Video / T2V:文生视频,用文字生成视频
- Image-to-Video / I2V:图生视频,用图片生成视频
- Seed(种子):控制生成结果的随机数,相同Seed+相同提示词=相同结果
- Steps(步数):AI迭代次数,越多细节越丰富但越慢
视频参数
- FPS(帧率):每秒画面数,24fps是电影标准,越高越流畅
- 分辨率:视频清晰度,常见720p、1080p、4K
- 时长:目前AI视频通常5-10秒,部分工具支持更长
- 宽高比:16:9横屏、9:16竖屏、1:1方形
功能术语
- 运动笔刷(Motion Brush):在画面上涂抹指定运动方向,让特定物体动起来
- 首尾帧(First/Last Frame):指定视频开始和结束的画面,AI生成中间过渡
- 镜头控制(Camera Control):推、拉、摇、移等镜头运动
- 扩展(Extend):延长视频时长
- 局部重绘(Inpainting):修改视频中某个区域
- 对口型(Lip Sync):让人物嘴型匹配音频
模型相关
- 大模型(LLM):大规模预训练AI模型,如GPT、可灵
- DiT:扩散Transformer,当前主流视频生成架构
- U-Net:早期扩散模型使用的网络架构
- LoRA:轻量级模型微调方法,可以训练特定风格
- Checkpoint:模型检查点,即模型文件
掌握这些术语,你就能看懂大部分AI视频教程和评测了。建议收藏本文,遇到不懂的词随时回来查。