上传一张起始图片,描述主体、镜头和环境应该如何运动,再用图生视频生成短片。当前图片、提示词、模型和视频设置会带入 Create 工作台继续创作。
图生视频是把静态图片转换成连续动态画面的 AI 生成方式,也常被称为图片转视频 AI。上传的图片会成为开场视觉状态,负责固定主体、构图、颜色、环境和美术方向;提示词则说明这些元素接下来如何变化。你可以控制主体动作、镜头移动、环境动态、节奏与氛围,而不必只靠文字重新搭建整个场景。图生视频 AI 适合让营销静帧、角色设定、商品概念、风景、分镜和社媒素材动起来。它不同于说话照片、幻灯片或普通视频剪辑:核心任务是根据起始图片合成新的运动和后续画面。
让图片动起来有效的图片生成视频指令会分别说明什么需要运动、什么必须稳定,以及镜头如何观察动作。让静态图片负责确定设计,让运动提示词负责建立时间变化。
用三个阶段完成图生视频:先建立可靠的起始画面,再给出一个连贯的运动方向,最后检查生成序列的连续性并针对问题调整。
选择清楚且取景合理的图片。只有在模型支持且最终构图重要时,再添加结束帧。
说明主体动作、镜头运动、环境变化、节奏,以及必须保持稳定的元素。
选择模型、时长、清晰度和其他可用设置。逐段检查身份漂移、细节扭曲、突然跳切和非预期运动。
图生视频先用起始图片确定视觉世界,再让每一个有效控制回答时间问题:什么需要运动、什么必须稳定、镜头如何观察,以及这段画面最终走向哪里。
起始帧控制
选择主体清楚、取景明确,并为预期动作留出空间的图片。图生视频 AI 在主体没有模糊裁切、背景支持计划镜头路径时,更容易保持开场构图。有些模型还支持结束帧,用来进一步约束视频最终到达的画面。
运动提示词
提示词应围绕时间变化来写:主体动作、镜头方向、环境动态、速度和情绪节拍。除非某个可见元素必须保持稳定,否则不必重新描述所有内容。聚焦的图生视频提示词能形成清楚的动作序列,避免多个事件互相竞争。
模型与输出
使用同一张图片和运动想法比较图生视频模型,检查主体稳定性、时间连续性、镜头逻辑、伪影、指令遵循、可用时长、清晰度和积分。Sender 会根据所选模型调整控制项,并把完整任务带入 Create。
了解图片生成视频时的起始图片、运动提示词、时长、声音、模型、积分、质量检查和商业制作问题。
图生视频会把上传图片作为开场状态,再根据运动提示词预测连续的新画面。图片固定外观与构图,提示词控制主体、镜头和环境如何变化。
优先使用主体清楚、取景明确、空间层次合理,并为计划动作留出余量的图片。图生视频模型面对模糊裁切、过小人脸、看不清的肢体或冲突透视时,更难保持连续性。
围绕时间变化描述主体动作、镜头移动、环境动态、速度和氛围,并补充必须保持稳定的内容。不要用完全无关的第二个场景替换源图片构图。
部分模型支持起始图与结束图,另一些只使用一张起始帧。Sender 会根据当前模型显示它实际支持的素材字段和设置。
不要默认所有模型都支持声音。图片转视频 AI 的音频能力取决于所选模型与工作流,生成前请检查模型控制项和任务说明;图生视频页面不会承诺每个模型都生成原生音频。
处理时间会随模型可用性、视频时长、清晰度、队列状态和服务响应变化。页面不承诺即时完成,请在 Create 中查看任务进度与失败状态。
检查图生视频结果时,应关注身份与形状稳定性、边缘变化、镜头逻辑、物体持续性、动作连续性、纹理闪烁、突然跳切,以及提示词中的动作是否真正发生。不要只看首尾帧。
页面不承诺免费不限量。视频生成会消耗积分,数量会随模型、时长、清晰度和其他设置变化;继续前请查看 Sender 中的预计消耗。