AI 视频的真实问题:动得不对,不是不动
现在的 AI 视频生成,画面质量已经不错,但运动往往失控:你想让云飘,结果整座山都在抖;你想让人物微笑,结果背景也在融化。
原因很简单——模型不知道你想让哪部分动。它需要被明确告知。运动笔刷这类工具解决的正是这个问题。
第一步:文生视频还是图生视频
先做这个选择,它决定了后面所有操作:
- 文生视频:从零生成,自由度最高,但画面不可控,适合探索创意、做抽象素材
- 图生视频:基于一张确定的图生成动态,画面基调可控,适合有明确视觉要求的商业内容
结论:除非你就是要随机探索,否则优先用图生视频。先用绘图工具或者实拍得到一张满意的静帧,再让它动起来,成功率比直接文生视频高出一大截。
好静帧的标准:构图清晰、主体突出、光线明确。模糊或元素杂乱的图,生成视频后问题会被放大。
第二步:用运动笔刷指定动态区域
这是核心功能。操作方式:在参考图上用笔刷涂抹你希望运动的区域,未被涂抹的区域保持静止。
典型应用场景:
- 让天空的云流动:只涂抹天空区域,建筑和地面保持静止,画面立刻有了高级感
- 让人物头发飘动:只涂抹头发部分,避免面部被扭曲
- 让水面波动:涂抹水面,岸边保持稳定
- 让火焰跳动:涂抹火焰,周围物体不动
笔刷范围的控制技巧:宁可涂大一圈,也不要涂得刚刚好。边缘留一点余量,运动过渡会更自然。涂得太贴合轮廓,边缘容易出现撕裂感。
同时注意:一次只涂一个区域效果最好。涂抹多个分散区域时,模型容易顾此失彼,导致其中一个区域不动或整体抖动。
第三步:调节运动强度
运动强度决定动的幅度。取值建议:
- 1 到 3:微动,适合营造氛围感,例如轻微的发丝飘动、烟雾缭绕
- 4 到 6:中等运动,适合大多数场景,如云的移动、水流、人物动作
- 7 到 10:剧烈运动,画面变化大,但形变风险显著上升
经验法则:先用中等强度试,效果不够再加。一上来就拉满,得到的往往是画面崩坏而不是动感十足。
另一个实用技巧:强度与笔刷范围要配合。小范围可以用高强度,大范围应该用低强度。整个画面都是高强度运动,看起来会非常廉价。
第四步:用镜头控制做专业运镜
除了画面内的运动,镜头本身的运动同样重要。常见选项:
- 推拉:镜头前进或后退,制造接近或远离的感觉
- 平移:横向移动,适合展示场景
- 环绕:围绕主体旋转,产品展示常用
- 升降:垂直移动,营造气势
- 固定:镜头不动,只让画面内容动
搭配原则:画面内运动复杂时,镜头要固定或微动;画面内运动简单时,可以用明显的镜头运动增加信息量。两者同时剧烈运动会让人眼花缭乱。
设置镜头运动时可以指定方向和幅度。幅度建议控制在中等,大幅度运镜容易导致画面结构崩塌,尤其是包含人物面部时。
第五步:写有效的视频提示词
视频提示词与图片提示词不同,重点在描述运动而非外观。结构建议:
主体 + 主体动作 + 环境变化 + 镜头运动 + 氛围
对比一下:
弱写法:一个美丽的海边日落——模型不知道该动什么,结果整个画面均匀抖动。
强写法:海浪缓慢拍打礁石,水花溅起,天空中云层缓缓移动,镜头缓慢向右平移,暖色调黄昏氛围——每个元素都有明确的运动描述。
关键区别:把静态的形容词换成动态的动词。不是美丽的海,而是海浪拍打。
第六步:延长与衔接
单次生成时长有限,需要更长的片段时使用延长功能。要点:
- 延长时以当前片段的最后一帧为起点,衔接会比较自然
- 每次延长前检查最后一帧的质量,崩坏的帧延长后只会更糟
- 多次延长后内容漂移会累积,建议控制在 3 次以内
- 需要精确的首尾衔接时,使用首尾帧功能,指定开始和结束画面
第三条是经验之谈。延长三次以上,画面往往会偏离初衷,不如分段生成再在剪辑软件里拼接。
常见问题与误区
- 问:涂抹了区域但没动?检查运动强度是否过低,或该区域在提示词中未被提及。笔刷和提示词要指向同一件事。
- 误区:把整个画面都涂上。全区域运动等于没有控制,与不用的效果差别不大。运动笔刷的价值恰恰在于选择性。
- 问:人物面部变形?降低运动强度,避免涂抹面部区域,镜头运动幅度调小。面部是形变高发区,尽量让它保持静止。
- 误区:追求一次生成完美长片。AI 视频目前更适合生成 3 到 5 秒的高质量片段,然后在剪辑软件里组合成完整内容。
- 问:生成结果和参考图差很多?图生视频仍会有偏差,尤其是高强度运动时。降低强度,或换用结构更简单的参考图。
效率数据与实测结论
以制作一条 15 秒的产品动态展示为例:纯文生视频方式平均需要生成 25 到 30 次才能得到可用素材,耗时约 2.5 小时;采用静帧加运动笔刷加镜头控制的工作流,约生成 10 次即可,耗时约 50 分钟,且素材一致性明显更好。
核心结论:AI 视频的瓶颈是控制力而非生成速度。把控制权拿回来——指定哪里动、怎么动、镜头怎么走——才是缩短工时的真正方法。指望随机生成撞出好结果,成本远高于看起来的一次生成费用。