← 回首页

图生视频:让一张分镜图动起来

文生视频适合从零构思镜头,但实际做分镜的时候,画面往往已经定了 —— 这时候用图生视频,把构图交给图片,模型只管"让它动"。 好消息是整个模型栈和文生视频完全一样,只多一个节点。

一、和文生视频差在哪

项目文生视频图生视频
模型(底模 / LoRA / CLIP / 双 VAE)完全一致,同一套文件
起始节点多一个 LoadImage
提示词作用描述画面内容只描述运动和镜头
分辨率 / 帧数 / 步数768×768 · 64 帧 · 4 步同上(14 个节点 vs 13 个)

模型文件与参数和上一篇完全相同,这里不再重复列 —— 需要的可以看 文生视频那篇的模型清单。

二、节点链路

LoadImage ──→ (参考图) ──────┐
UNETLoader ─→ LoRA ─→ SigmaShift ─┤
CLIPLoader ───────────────────────┤
VAELoader ×2 ─────────────────────┤
                                  ↓
                     MiniMaxH3ImageToVideo(prompt="运动描述")
                                  ↓
                       KSampler → CreateVideo → SaveVideo

唯一的变化:参考图接进 MiniMaxH3ImageToVideo 的 image 输入, 采样和输出部分原封不动。

三、提示词怎么写

图生视频的提示词要换个思路:画面已经给了,你说的是"接下来怎么动"。

要表达的示例写法
角色动作the character moves naturally, slight head turn
镜头运动subtle camera push-in / slow pan to the right
整体质感cinematic, 4k, shallow depth of field
一个常见误区:把出图时的提示词原样粘过来。那等于让模型把画面重画一遍, 结果就是角色变脸、构图漂移。图生视频的提示词只写动态

四、参数与注意点

五、什么场景用它

实际做的时候,这两条路线通常是配合用的:文生视频出关键画面 → 挑满意的当分镜 → 图生视频让它动起来。

← 上一篇:文生视频 · 下一篇:人像一致性 →