图生视频工作流:把静态图变成可控镜头

11 min · 更新于 2026-09-12 · NamiFusion 团队

准备可靠首帧、描述运动、选择兼容控件,并按镜头检查图生视频结果。

图生视频为静态图增加时间、相机运动与主体运动。源图负责构图和外观,提示词应说明首帧之后发生什么,因此源素材质量比华丽的运动词更重要。静态图里被裁切的手、难辨的物体、矛盾的反射或模糊的空间层次,在运动后会更加明显。NamiFusion 的 Video 标签提供不同方法和模型专属素材槽:有的必须上传首帧,有的首尾帧可选,有的接受多张参考,还有视频编辑路径要求源视频。请遵循所选模型当前显示的表单,不要套用其他模型的控件。

准备首帧与镜头说明

选择主体清晰、透视一致,并为预期运动留出空间的源图。重要肢体和物体应完整处于画面内。推镜需要焦点区域具备足够分辨率与细节;横移应在运动方向保留合理空间;人物动作则避免从已接近生理极限的姿势开始。若文字必须完全可读,应移除或设计为保持静止。还要确认你有权让画面中的人物、作品、标志或商品动起来。

用四部分写单镜头说明:主体动作、相机动作、环境运动和结束状态,并确保它们在物理上兼容。“人物向左走”和“相机向右环绕并快速变焦”同时出现,往往会让短片负担过重。明确哪一种运动主导镜头,同时写明必须静止的内容,例如商品结构、人物身份、背景建筑或水平线。

执行图生视频任务

  1. 打开 AI Generator 并选择 Video 标签。
  2. 选择视频方法与模型,检查其素材槽和必填标记。
  3. 把静态图加入该模型显示的首帧或参考图槽。若有尾帧槽,只有在尾图中的人物身份、构图与场景几何都能与首帧合理衔接时才使用。
  4. 输入运动提示词。
  5. 只有当前模型显示时才设置时长、比例、分辨率、声音等控件;部分图生视频路径的画幅会跟随源图。
  6. 查看费用估算并生成。
  7. 在历史记录中等待完成,切换页面不会让排队任务更快。
  8. 下载结果,或把审核通过的静帧/结果用于明确规划的下一镜头。

提示词练习:描述随时间发生的变化

以下提示词是练习,并不声称任何展示视频由它生成:“保持陶瓷瓶与印刷标签不变。镜头全程只做一次缓慢的 10 厘米推近。柔和高光逐渐沿瓶身右侧移动,背景帘因气流轻微摆动。瓶体、瓶盖、标签文字、桌面和水平线保持固定。自然缓入缓出,曝光稳定,不切镜,不增加物体,以稳定的产品近景结束。”它包含一个相机动作、一个轻微环境变化、受保护元素与结束状态。精确单位可以表达意图,但不保证模型产生可测量的物理位移。

单镜头运动提示词
Keep the ceramic bottle and printed label unchanged.
One slow camera push-in. A soft highlight travels along the bottle's
right edge; the background curtain moves slightly from airflow.
Bottle, cap, label, tabletop, and horizon remain fixed.
Stable exposure, no cuts, no extra objects, end on a steady close frame.

逐帧检查运动

先按正常速度观看叙事与节奏,再静音检查视觉连续性,最后在转折处逐帧查看。对照源图检查开场帧,并寻找形状扭曲、标志或面孔变化、多余肢体、物体消失、接触点滑动、反射矛盾、曝光闪动、机位跳跃与背景不稳。确认动作起止干净,尾帧能与下一镜头剪接。启用声音时应单独试听,画面可信并不代表音频可用。任务技术状态显示完成,不等于内容已经通过审核。

返修失败并控制成本

运动过度时,删除次要动作,改成锁定机位或一次缓慢运动;画面僵硬时,指定一个方向与终点明确的可见动作;人物或物体漂移时,换用更干净的首帧,若有时长控件可缩短镜头,并在第一句保护识别细节;首尾帧跳变时,让终点更接近或先去掉尾帧;背景不稳时,简化景深层次和环境运动。时长、分辨率、接受素材、排队时间、声音支持和积分成本都随模型与设置变化。先用满足验证需求的最小任务测试概念,提交前看当前估算,运动成立后再提高画质或时长。

常见问题

必须提供尾帧吗?+

只有显示尾帧槽的模型才能使用,且部分路径为可选。尾图与起点视觉兼容时再用,否则可靠首帧加运动提示词通常更易控制。

为什么画幅比例控件会消失?+

控件由模型决定,部分图生视频路径会沿用源图比例。应以所选模型当前显示的表单为准。

可以持续延长生成视频吗?+

不可以。可用时长与续写能力取决于当前模型。串联多次任务会累积身份、结构和运动误差,因此每个衔接点都要检查并保留审核锚点。