H3 导演台全能教程:时间线分镜,一段一个镜头(加速版)

2026-08-19 14:52 · 319 阅读
Minimax H3 实战 · 第 8 篇 / 共 20 篇 查看系列 →
H3 导演台全能教程:时间线分镜,一段一个镜头(加速版)

H3 导演台全能是什么?能做什么

这一篇的主角是导演台全能(加速版)——它是 H3 系列里最"一体化"的工作流:一条时间线上可以排多个段(segment),一段就是一个镜头,每段独立选模式、放图、写提示词,最后一次性生成一段多镜头短片,自带声音(对白、环境音、音效由模型生成)。

它能做什么?

  • 时间线分镜短片:像剪映一样把镜头一段段排好,一段一个镜头,一次生成完整短片
  • 一段一模式:每个段可以单独切换生成模式(共 6 种),文生、图生、视频生混合编排
  • 竖屏输出:默认竖版 3:4,直接适配抖音/快手等短视频平台

和 H3 系列其他工作流的区别:它是全能调度台——别的管线管一种玩法,它把所有玩法都装进一条时间线,适合做有剧情的多镜头短片。

6 种任务模式(先认识,本篇实战用 i2v)

导演台全能的核心是任务模式(taskType),一共 6 种,决定了每个镜头用什么方式生成:

模式全称输入说明
t2v文生视频纯提示词一句话直接生成视频,不需要任何图
i2v单图生视频1 张图 + 提示词参考图驱动生成,运动自由自然,本篇主角
fl2v首尾帧生视频首帧 + 尾帧 2 张图两张图之间插值过渡,适合精确转场和循环动画
r2v参考图生视频参考图 + 提示词多参考图锁定人物/场景(需换 ref2va 底膜)
v2v视频生视频一段视频 + 提示词用视频驱动生成(需换 ref2va 底膜)
rv2v参考+视频生视频参考图 + 参考视频图和视频一起驱动(需换 ref2va 底膜)

b6ffd67e-d92c-4c53-8b99-6becdcdedbd6.png

⚠️ 底膜规则:t2v / i2v / fl2v 三种模式用 fl2va 底膜(本篇工作流默认就是);r2v / v2v / rv2v 三种需要把底膜换成 ref2va(工作流里 UNETLoader 节点下拉切换即可)。先定模式,再选底膜——这是最容易踩的坑。

本篇实战:深夜的星光信使(i2v 四镜头短片)

我们用一个原创剧情练手——《深夜的星光信使》:深夜城市里,一位短发少女(白色连帽卫衣、浅蓝围巾)捧着装满金色星光的玻璃瓶,把人们失落的星光送回路灯。4 个镜头,每段 5 秒,竖版 3:4,正好是抖音短视频的规格。

镜头一:天台仰望星空 → 镜头二:霓虹巷子奔跑 → 镜头三:路灯前点亮星光 → 镜头四:城市俯瞰星河。全程用 i2v 模式生成。

第 1 步:打开导演台全能工作流

启动 ComfyUI,打开 AI星尘-Minimax H3 文件夹里的 H3导演台全能工作流(加速).json。

d4f05050-e6c7-4be1-b1c7-dd1e632c24d7.png

模型已配好:fl2va 底膜(int8 量化版)+ Qwen3VL-32B 文本编码器 + 双 VAE(视频+音频),开箱即用。工作流自带一段示例(一个猴子的三段故事),我们先清空它,再排自己的镜头。

第 2 步:清空示例段

双击 MiniMaxH3Director 节点打开导演台编辑器,时间线上已有示例的段(猴子的三段故事)。把示例段全部删除:选中段 → 删除,清空时间线。

第 3 步:切换 i2v 模式(本篇关键)

导演台默认是 fl2v(首尾帧)模式,我们换成 i2v(单图生视频):在导演台顶部找到 任务模式下拉,选 i2v — 单图生视频(Image-to-Video)。

362e0dc2-2ec9-4c70-86f6-95548a224e37.png

为什么要换?fl2v 是"首尾帧插值"——模型在两张图之间机械过渡,运动容易僵硬;i2v 是"参考图 + 提示词直接生成"——模型自由发挥运动,丝滑自然。做叙事镜头优先 i2v(文末有专门的取舍讲解)。

第 4 步:新建 4 个段,每段放一张镜头图

在时间线上新建 4 个段,每段 5 秒。每个段点击「添加图片」放入对应的镜头图(i2v 模式只需要 start 图):

  • 段1:镜头1图(少女天台仰望星空,玻璃瓶里星光漂浮)
  • 段2:镜头2图(少女在霓虹巷子奔跑)
  • 段3:镜头3图(少女蹲在老式路灯前)
  • 段4:镜头4图(城市高空俯瞰星河画面)

image.png

镜头图怎么来?先用 Qwen-Image 4 步版出一张角色基准图,再用 Qwen-Image-Edit 从基准图编辑出不同场景/动作的 4 张图(人物保持一致),最后放进导演台——参考图和提示词双重锁定,人物一致性最好。

第 5 步:填提示词(强动态写法)

每个段的提示词决定这段视频"动什么、怎么动"。H3 的脾气:提示词不写动的,它就给你静态。所以每段至少写 2~3 个明确的动态元素(人物动作 + 镜头运动 + 环境变化),避免"缓慢""轻柔"这种弱动态词。

四段提示词(可直接复制):

段1(天台仰望):

深夜城市天台,短发少女(白色连帽卫衣、浅蓝围巾)背对镜头仰望星空,镜头快速环绕少女旋转,玻璃瓶里金色星光喷涌而出,大量星光粒子急速飘动环绕她旋转,风吹起她的衣角和围巾,云层快速流动,远处城市灯光闪烁。伴随风声。

段2(霓虹巷子奔跑):

深夜霓虹巷子,短发少女(白色连帽卫衣、浅蓝围巾)快速奔跑,玻璃瓶口喷出一串金色星光粒子在身前急速飞舞引路,雨水不断落下溅起水花,地面霓虹倒影随水波晃动,两侧霓虹灯牌闪烁。镜头跟拍晃动,伴随脚步声和雨声。

段3(路灯前点亮):

深夜街道,短发少女蹲在一盏熄灭的老式路灯前,双手倾倒玻璃瓶,金色星光如水柱涌出快速流入灯罩,路灯猛然亮起,光芒向四周蔓延照亮街道,星光粒子从灯罩口溢出飘散,雾气在光柱中流动。镜头快速推进到近景,伴随光芒嗡鸣。

段4(城市俯瞰):

城市高空俯瞰,镜头急速拉升,街道上一盏盏路灯接连快速亮起,暖黄光带如水蔓延铺开,金色星光粒子从路面大量升起,旋转汇成星河贯穿城市,云层快速掠过,城市霓虹闪烁。壮阔动态远景。

写提示词的要点:人物动作(奔跑/倾倒)、镜头运动(环绕/拉升/跟拍)、环境动态(雨水/雾气/灯光闪烁)三样至少占两样,画面就不会僵。

第 6 步:设置输出,点运行

运行前看一眼输出设置(导演台内):

  • 分辨率:默认竖版 3:4(576x736),适配抖音/快手竖屏;想横版切 16:9 并调高分辨率(参考工作流自带的尺寸对照表)
  • 帧率:24fps,默认不用动
  • 每段时长:5 秒(拖动段边缘调整,段越长生成越慢)

然后点「运行」——4 个段依次生成,成片在「保存视频」节点(输出目录 video/MiniMaxH3_Director_t2v),自带声音(每段提示词里写了伴随的音效)。

image.png

MiniMaxH3_Director_t2v_00003_.gif

干货:i2v 和 fl2v 怎么选

很多新手用导演台默认的 fl2v 模式,发现生成的运动"僵硬"——这不是模型问题,是模式选错了:

  • i2v(单图生视频):参考图 + 提示词直接生成,运动自由、丝滑自然——叙事镜头(人跑、动作、镜头运动)用它,本篇全程用它
  • fl2v(首尾帧生视频):模型在首尾两张图之间插值过渡,运动自由度低,容易僵硬——但它能精确控制画面起点和终点,适合两种场景:无缝循环动画(首尾帧用同一张图,生成循环播放的背景/旗帜/雨景)和精确转场(上段尾帧当下段首帧,画面严丝合缝)

一句话总结:要自然运动用 i2v,要精确控制用 fl2v。

常见问题

  • 生成的视频很僵硬?大概率在用 fl2v(默认模式)——切成 i2v 立刻丝滑;另外检查提示词有没有写足动态元素(动作/镜头/环境)
  • 报错"Generation segment image could not be loaded"?段里的图文件不存在(比如工作流自带的示例图不在你的 input 目录)——删掉或替换成自己的图即可
  • 想用 r2v/v2v 模式?先把 UNETLoader 的底膜从 fl2va 换成 ref2va,再切模式(先定模式再选底膜)
  • 保存工作流报 400 文件名非法?别用中文+全角括号做文件名,保存成英文名(如 H3DirectorAllInOne.json)
  • 显存不足?分辨率调低一档(竖版 576x736 已经很低配),或把每段时长缩短

小结

导演台全能 = 一条时间线装下 6 种生成模式。本篇用 i2v 实战了四镜头剧情短片《深夜的星光信使》:清空示例 → 切 i2v → 每段放图 + 强动态提示词 → 运行出片。记住两个口诀:叙事镜头用 i2v,精确控制用 fl2v;提示词不写动的,画面就是静的。

登录后分享可赚邀请积分
评论 (0)

登录后才能发表评论

去登录