九宫格分镜:上传一张参考图,9 行提示词生成 9 个连贯镜头
一句话介绍
上传一张角色参考图,写 9 行分镜提示词,一次生成 9 张连贯镜头分镜图——同一角色、同一风格、镜头逻辑衔接,不用 AI 视频模型也能快速做分镜预览。基于 FLUX2-KLEIN 9B,4 步出图,中文提示词直接写,ReferenceLatent 技术锁死角色一致性。
亮点
- 9 行提示词 = 9 张分镜图:每行一个镜头,一次运行全部生成,不用逐格跑图
- 角色一致性锁死:参考图注入每个镜头的生成过程(ReferenceLatent),9 格同一角色、同一服装、同一风格
- 镜头逻辑连贯:内置「焦点接力」分镜方法论——镜头 A 的结尾动作衔接镜头 B 的起始状态,像电影剪辑一样
- 4 步超快出图:FLUX2-KLEIN 9B,一次 9 张几十秒内完成
- 中文提示词直接写:Qwen3-8B 文本编码器,镜头描述全中文
- 参考图自由:角色概念图、实拍照片、AI 生成的图都能当参考,想换角色只换图
适合哪些场景
- 短视频分镜:写脚本后先出分镜图给团队/甲方看,不用等视频渲染
- 漫画/动画分镜:一页 9 格的故事板,预览剧情节奏
- 广告创意:同一个 IP 角色的多镜头广告画面,风格统一
- 游戏 CG / PV:角色设定图直接扩展成多镜头展示
- 自媒体封面组图:一个角色的系列图,保证形象统一
准备工作
环境:ComfyUI + FLUX2-KLEIN 模型(AI星尘 ComfyUI 整合包 V10.0 内置,开箱即用)。
参考图:一张角色概念图。这是整个工作流的核心,有两条硬性要求:
- 必须横版:生成画布固定横版 1280×720,竖图参考会被拉伸变形
- 和分镜提示词同主题:参考图是什么角色,分镜就要写什么角色——参考图是只老虎、提示词写钢铁侠,出来的图就是老虎头钢铁侠身的缝合怪(详见文末踩坑)
没有概念图?先用 FLUX2-KLEIN 文生图工作流(同一个模型家族,风格天然统一)生成一张:七分身立绘 + 简洁纯色渐变背景,角色居中占主体,服饰细节写丰富些(分镜的特写镜头全靠这些细节)。

使用步骤
第 1 步:打开工作流
整合包工作流列表:AI星尘工作流 → 图像 → 分镜图+局部修复 → FLUX-Klein一致性九宫格分镜—超强连贯性+超快生成.json

第 2 步:换上你的参考图
双击 LoadImage 节点,上传你的角色概念图。图会先按比例缩放(最长边 1920),右侧预览图即生成画布尺寸。

第 3 步:写 9 行分镜提示词
找到 easy promptLine 节点(画布上有红色注释「这个提示词工程,只需修改"几组"就行」——说的就是这里),每行一个镜头,格式:景别/角度 :: 画面描述 :: 情绪氛围。工作流默认是钢铁侠示例,直接整体替换。

第 4 步:运行
点右上角运行。4 步采样,一次生成 9 张图自动保存到 output 目录。9 张同时跑,显存不够时 ComfyUI 会自动分批,属于正常现象。
实战案例:元气少女的樱花雨(9 镜全文)
参考图:粉紫双马尾日系可爱少女立绘(FLUX2-KLEIN 文生图生成)。分镜故事线:樱花公园里接住一片花瓣。以下 9 行直接复制到 easy promptLine 节点即可复现:
Next Scene:1) 全景入画 :: 春日樱花公园,淡紫色渐变双马尾的元气少女站在樱花树下,白色娃娃领衬衫配粉色开衫毛衣,紫色蓬蓬裙被微风轻轻吹起,粉白色樱花花瓣漫天飘落,阳光透过花枝洒下斑驳光点 :: 明媚,梦幻
Next Scene:2) 推进/聚焦 :: 镜头缓慢推近,聚焦于少女紫粉色的大眼睛,瞳孔里映着飘落的樱花,粉色缎带蝴蝶结在发间轻轻晃动,珍珠choker在锁骨上闪着细碎的光 :: 细腻,灵动
Next Scene:3) 触发/诱因 :: 一片粉白樱花花瓣悠悠飘落到少女面前,她睫毛轻颤,目光追随着花瓣划过的弧线,裙摆和缎带随微风轻轻飘起 :: 期待,专注
Next Scene:4) 反应/互动 :: 少女开心地踮起脚尖,伸出双手去接那片花瓣,白色蕾丝袖口滑落露出纤细手腕上的粉色缎带手链,紫色蓬蓬裙裙摆蓬松展开 :: 雀跃,兴奋
Next Scene:5) 过程/流动 :: 少女追着被风吹远的花瓣小跑,淡紫色双马尾在身后甩出漂亮的弧线,粉色开衫衣摆和裙摆随风飞扬,玛丽珍小皮鞋踏在落满花瓣的草地上 :: 活力,奔跑
Next Scene:6) 极近特写/高潮 :: 少女双手轻轻捧住花瓣,脸上绽放出灿烂的元气笑容,脸颊红晕如樱花,粉色缎带蝴蝶结在她额前飘动,阳光为她镀上柔和的轮廓光 :: 心动,高光时刻
Next Scene:7) 变化/后果 :: 一阵春风卷起漫天樱花,花瓣如粉色雪片包围少女,她仰头望向花雨,紫色蓬蓬裙和缎带被风托起,周围的光点像星星一样闪烁 :: 浪漫,惊叹
Next Scene:8) 余韵/局部 :: 镜头聚焦在少女肩头,一片樱花花瓣轻轻落在白色娃娃领的蕾丝花边上,旁边斜挎的粉色小包上,爱心挂坠随着她的呼吸微微晃动 :: 静谧,细节
Next Scene:9) 大远景/拉高 :: 镜头垂直拉高,少女站在漫天樱花雨中回头微笑,身影逐渐融入粉色花海与蓝天之间,双马尾上的缎带蝴蝶结是最后消失的光点 :: 温暖,余韵悠长
分镜提示词怎么写:镜头衔接的套路
9 行提示词不是随便写 9 个画面,工作流内置了作者的分镜方法论(画布上的模板说明),核心是「焦点接力」:每个镜头的结尾动作,衔接下一个镜头的起始状态——
- 物理接力:镜头 A 结尾手触碰到门 → 镜头 B 从门被推开的缝隙看进去
- 视线接力:镜头 A 结尾角色看向天空 → 镜头 B 是仰视视角,展示角色眼中的景象
- 环境接力:镜头 A 结尾一阵风吹乱头发 → 镜头 B 是一片被风吹起的树叶掠过镜头
9 个镜头的通用结构(任何题材都套这个框架):
- 全景入画:大环境 + 角色身处其中
- 推进/聚焦:镜头推近,聚焦角色某个局部(眼睛/手/配饰)
- 触发/诱因:环境微小变化引起角色注意(花瓣飘落/光线移动/声音)
- 反应/互动:角色做出反应(转头/伸手/起身)
- 过程/流动:动作进行中(小跑/抚摸/哭泣)
- 高点/特写:关键瞬间或情绪最高点
- 变化/后果:动作让环境产生反馈
- 余韵/局部:聚焦后果的细节
- 拉远/出画:镜头拉远,角色融入环境或离开
战斗题材换「动作衔接协议」:镜头 N 结尾动作 → 镜头 N+1 起始状态,9 镜头是静止 → 微动 → 预备 → 爆发 → 高潮 → 惯性 → 余韵 → 凝固,同一个框架。
写句子的 3 个要点:
- 特征每句写全:模型不吃代词,每句都重复角色关键特征(双马尾/蝴蝶结/蓬蓬裙),一致性才锁得住
- 描述要具体:材质、颜色、动作细节写清楚(蕾丝袖口、缎带手链、玛丽珍鞋)
- 情绪标签收尾:每句末尾用 `::` 加两个词点出氛围,控制整体基调
原理:为什么 9 张图能保持一致
靠的是 ReferenceLatent(参考潜空间)技术:参考图被编码成 latent 后,同时注入正面和负面条件——生成时每个镜头都以参考图为"锚",画面特征被反复拉回参考图方向,所以 9 格的角色、服装、风格天然统一。这也解释了为什么参考图必须是横版、必须和提示词同主题:锚长什么样,9 格就长什么样。
「9 张图」的实现:easy promptLine 节点把多行文本拆成 9 个独立提示词,ComfyUI 自动把生成批次展开成 9 张,一个都不少。
提速技巧
- 降分辨率:生成画布由两个 INTConstant 节点控制(默认 1280×720),改成 1024×576 快约 1.5 倍、768×432 快约 2.7 倍——分镜是预览稿,小图够看,满意再放大重跑
- 换 4B 模型:UNETLoader 换 flux-2-klein-4b-fp8,速度约 2 倍、显存减半
- 4 步已是极限:FLUX2-KLEIN 原生 4 步收敛,别再往下压
- 显存不够自动分批:9 张同时跑不下时 ComfyUI 自动分 2-3 批,属正常现象
踩坑记录
坑 1:参考图和提示词主题不一致 → 缝合怪。默认参考图是只老虎,示例提示词是钢铁侠——两股力量互相撕扯,9 格里有老虎头也有钢铁侠头。一致性工作的第一原则:参考图是什么角色,分镜就写什么角色。
坑 2:换模型必须换配套文本编码器。FLUX2-KLEIN 的 9B 模型配 Qwen3-8B 编码器,4B 模型配 Qwen3-4B 编码器,不能混用。只换 UNET 不换 CLIP 会直接报错:RuntimeError: mat1 and mat2 shapes cannot be multiplied(8B 编码器输出 12288 维,4B 模型只认 3072 维,维度对不上)。修法:CLIPLoader 里把模型换 qwen_3_4b.safetensors,类型保持 flux2 不变。
坑 3:竖图参考被拉伸。生成画布固定横版,竖版参考图会被压扁/裁切,角色变形。参考图一律用横版。
小技巧
- 换角色 = 换图 + 换第 1 行描述:参考图换成新角色,9 行提示词里把角色特征段替换,其余镜头逻辑不用动
- 先跑小尺寸验证:768×432 快速跑通确认镜头连贯性,满意再上 1280×720 出正式图
- 单格不满意改单行:哪一格构图趋同/特征漂移,把那一行的描述写得更具体(加方位、加材质)重跑
- 固定种子对比:RandomNoise 种子固定后重跑,方便微调对比
- 生成前先预览参考图:PreviewImage 会显示缩放后的画布尺寸,确认比例没问题再跑