图片是第一帧,不是完整视频
把图片上传以后,真正要告诉视频模型的不是“这张图里有什么”,而是接下来几秒发生什么。图片已经决定了人物、构图、光线和大致风格,文字应该主要描述动作、环境变化和镜头。
一张图片负责起点,提示词负责时间。
方法一:一张首帧加一个主要动作
最简单的方法是只上传一张首帧,然后写一个动作。先别同时要求人物转身、走路、挥手、镜头环绕和背景爆炸。动作越多,短短几秒里越容易挤在一起。
- 人物:镜头固定,人物抬头看向窗外,头发被微风轻轻吹动。
- 商品:镜头缓慢向前推进,瓶身保持不动,背景光线从左向右移动。
- 插画:云朵缓慢向右漂移,水面出现轻微波纹,画面保持手绘质感。
Runway 的图片转视频指南也建议把文字重点放在主体动作、环境运动、镜头运动、速度和方向上,并从最重要的一个动作开始逐步增加。
方法二:用首帧和尾帧控制终点
如果你已经知道视频最后要停在哪里,可以同时提供首帧和尾帧。工具会尝试补出中间变化,适合商品从包装状态变成展示状态、画面从白天过渡到夜晚,或者一个镜头从远景走到近景。
Adobe Firefly 和 Google Flow 当前都提供首尾帧方式。两张图应该有能够连续变化的构图;如果人物位置、镜头角度和背景完全对不上,模型只能强行变形或突然切换。
先用同一张图做轻微改动得到尾帧,通常比拿两张毫无关系的图直接连接更稳。
方法三:多段视频要继续带着参考素材
做多段视频时,只靠上一段最后一帧接着生成,人物和商品仍可能越变越远。一些工具允许把人物、商品或场景图片作为持续参考。Google Flow 把这类素材称为 ingredients,并建议主体或商品参考使用干净、简单的背景。
参考图不是锁死按钮。连续生成以后仍要检查脸、衣服、包装文字、按钮和颜色。重要商品如果变形,宁可缩短镜头、减少动作,或者把商品保持静止,只让背景与镜头轻微运动。
最容易失败的五个地方
- 人物突然变脸:输入图的脸太小、模糊或已有错误;先换清晰图,再减少大幅转头和遮挡。
- 商品包装变形:动作和镜头太激烈;让商品保持静止,只做推近、光影或背景运动。
- 镜头自己乱跑:提示里只写了氛围,没有写镜头;明确使用固定镜头、缓慢推近或向左平移。
- 中间突然切镜:短时间塞了多个场景;一次只做一个连续镜头,多个镜头分别生成后再剪。
- 想静止却一直动:视频模型本来就倾向产生运动;写清画面里唯一允许动的对象,生成后仍可用剪辑软件稳定。
还要检查输入图里的运动暗示。Runway 的指南举例说明,带扬尘和运动模糊的车很难按提示保持静止。输入图已经在“往前冲”,文字却要求完全不动,两个信号会互相打架。
一套更省额度的制作顺序
- 先修输入图:脸、手、商品文字和边缘本身要正确。
- 只生成最短可用片段,先验证一个动作和一个镜头。
- 动作对了再加速度、环境变化和第二个镜头,不要一次写满。
- 多生成几版,只保留中间稳定的几秒。
- 最后到剪辑软件里裁切、稳定、补字幕、声音和转场。
图片转视频更像生产镜头素材,不像一次生成完整成片。把每段控制在一个动作,失败时先改图片和运动要求,通常比不停追加“高质量、电影感”更有用。
官方资料
本文的首帧、尾帧和运动提示说明来自:



