人物三视图:上传一张参考图,AI 生成右侧面/正面/背面三视图
一句话介绍
上传一张人物参考图,AI 保持你的角色面貌,一次生成右侧面 / 正面 / 背面三视图——游戏角色设定、手办建模、漫画人设的标准素材,一套 ComfyUI 工作流 8 步出图。基于 Qwen-Image-Edit 多图编辑模型,中文提示词直接写,服装配饰随便换,脸还是那张脸。
亮点
- 一张图出三视图:上传 1 张参考图,一次生成右侧面 / 正面 / 背面 3 个角度,人物居中且大小一致
- 面貌严格继承:多图编辑模型 + 指令式提示词「保留参考人物五官特征」,脸型、五官比例不跑偏
- 中文提示词直接写:发型、服装、配饰、神态全用中文描述,不用翻译成英文提示词
- 3D 三渲二质感:顶级二次元手游立绘 / 手办建模渲染效果,轮廓干净锐利、光影柔和通透
- 8 步快速出图:Lightning 加速 LoRA,1440×1920 高清直出,几十秒出结果
- 换装自由:想换造型只改提示词「人物设定」一段,五官和角度保持不变
三视图能用来做什么
- 角色设计:游戏 / 漫画 / 动画的角色设定图,行业标准交付格式就是正面 + 侧面 + 背面
- 手办 / 建模:建模师需要三向参考图建模,缺一个角度都难受
- VTuber / 虚拟形象:立绘之外补充多角度人设素材
- 插画商稿:接稿遇到"多角度展示角色"的需求,直接出底稿
准备工作
环境:ComfyUI + Qwen-Image-Edit 模型(AI星尘 ComfyUI 整合包 V10.0 内置全套模型,开箱即用,无需额外下载)。
参考图:一张清晰的人物正面图。参考图质量直接决定出图上限:
- 正面朝向,五官清晰无遮挡(刘海别挡住眼睛)
- 人物尽量大、居中,背景干净
- 像素别太低(建议 ≥512px)
- 头像、半身、全身都行——模型保持脸型,服装按提示词重画
使用步骤
第 1 步:打开工作流
整合包工作流列表:AI星尘工作流 → 图像 → 图像生成 → 人物三视图生成工作流V1.json

第 2 步:放入参考图
工作流左侧的「图像管理器V2」节点指定了输入目录:把参考图放进 ComfyUI 的 outputavatar 文件夹,点节点上的刷新按钮,在下拉列表里选中你的图。

第 3 步:粘贴提示词
在「通用提示词」节点(PrimitiveStringMultiline)里粘贴下方完整提示词。第一段是三视图指令(必须保留),「1. 人物设定」整段可以改成你自己的角色。

第 4 步:关掉多余 LoRA(关键一步!)
工作流默认加载了 7 个 LoRA,实测必须只保留 2 个,否则出图明显发糊:
- ✅ 保留 Lightning-8steps:加速 LoRA,让 8 步采样就出完整细节
- ✅ 保留 multiple-angles:三视图专用 LoRA,控制三个角度的一致性
- ❌ 其余 5 个全部关闭——其中 Cinematic(电影感)、Kook_Qwen_V3极致真实、qwen_realistic_skin(真实皮肤)都是写实/电影方向,和动漫三渲二诉求冲突,叠在一起会"打架",画面细节互相干扰发糊

第 5 步:运行出图
点右上角运行。参数保持工作流默认即可:8 步采样、CFG 1、尺寸 1440×1920。跑完在右侧预览,自动保存到 outputsucai 文件夹。

提示词全文(实测跑通,直接复制)
根据以下要求,严格使用提供的图片人物面貌生成一张三视图(右侧面、正面、背面),三个视图并排,从左到右依次为:右侧面、正面、背面,人物居中且大小一致,保留参考人物的五官特征不变
1. 人物设定
参考人物:根据参考图片中的人物形象,保留其五官轮廓与面部特征,不得凭空捏造或改变脸型、五官比例。
发型:亚麻灰紫色渐变双马尾,发丝蓬松柔顺,带动漫式高光,刘海齐眉,两侧碎发自然垂落。
上装:白色高领针织毛衣,外搭黑色短款外套,衣领和袖口带精致蕾丝边装饰。
下装:深蓝色百褶短裙,裙摆自然垂下,搭配黑色过膝袜。
鞋子:黑色圆头小皮鞋,鞋面带蝴蝶结装饰。
配饰:一条银色锁骨链,左耳一枚星星耳钉,无其他夸张饰品。
神态气质:元气中带一点傲娇的动漫少女气质,嘴角微微上扬,眼睛明亮有神。
2. 渲染风格(重要)
3D 动漫角色风格:采用高质量的 3D 卡通渲染(三渲二)质感,类似顶级二次元手游角色立绘、手办建模渲染的效果。皮肤为柔和的次表面散射质感,五官动漫化但保留参考人物的面部特征,头发有动漫式高光,服装有 3D 物理质感,轮廓干净锐利,光影柔和通透,色彩明快饱和。必须是 3D 渲染的动漫角色形象,不是写实照片,也不是 2D 平面插画。背景为纯色渐变底,突出角色本体。提示词拆解:三段式写法
这条提示词能跑通,靠的是三段式结构——以后写任何 Qwen-Image-Edit 编辑类提示词都可以套这个框架:
第 0 段:三视图指令(做什么)
开头直接用指令句:生成什么、几个角度、并排顺序、人物要求。注意要指令式——「生成一张三视图,三个视图并排」这种祈使句才生效,只写名词短语(比如"三视图")模型经常不执行,这是 Qwen-Image-Edit 系列的特性。
第 1 段:人物设定(长什么样)
发型、上装、下装、鞋子、配饰、神态逐项列清楚,每项写颜色和细节(动漫式高光、蕾丝边装饰、蝴蝶结)。这段要具体:越具体出图越准,AI 越没有自由发挥的空间。
第 2 段:渲染风格(什么质感)
最后锁定画面质感:3D 三渲二、次表面散射皮肤、动漫高光,并明确排除——「不是写实照片,也不是 2D 平面插画」。风格段是防止模型跑偏到错误方向的护栏。
参数为什么这样调
为什么 8 步就够?Qwen-Image-Edit 配合 Lightning 加速 LoRA,8 步已经收敛到稳定画面,实测加到 16 步并不会更清晰,反而更慢。采样器保持工作流默认(dpmpp_2m_sde / simple)即可。
为什么 CFG 是 1?Qwen 系编辑模型官方推荐 CFG 1,提示词遵循度靠模型本身的理解能力,不是靠 CFG 放大。
为什么 LoRA 只留 2 个?这是本次实测踩出来的最大坑(见下)。
踩坑记录:LoRA 不是越多越好
工作流默认挂了 7 个 LoRA:Lightning(加速)、multiple-angles(三视图)之外,还有 Cinematic(电影感)、Kook_Qwen_V3极致真实、qwen_realistic_skin(真实皮肤)等写实方向 LoRA。第一次全开跑,出图明显发糊——写实向 LoRA 要把画面往"真实照片"拉,动漫三渲二诉求要把画面往"干净卡通"拉,两股力量在每一步采样里互相拉扯,细节被互相覆盖。
只留 Lightning + multiple-angles 后,画面立刻干净锐利。经验:LoRA 是风格叠加,方向冲突的 LoRA 不能同时开。动漫需求就留动漫向,写实需求就留写实向;Lightning、multiple-angles 属于功能型 LoRA(加速 / 多角度),不受风格影响,可以一直留着。
小技巧
- 换角色:只改提示词第 1 段「人物设定」,参考图和其余段落不动——脸不变、角度不变,服装换成你的新设定
- 换风格:改第 2 段「渲染风格」,写实风、古风、赛璐璐 2D 都可以试;走写实风的话建议额外留一个写实向 LoRA
- 参考图不理想:换一张更清晰、更正的正面图,或者先用文生图工作流跑一张满意的图再拿来当参考
- 批量做人设:同一张参考图 + 不同「人物设定」段 = 同一个角色的不同服装方案,做角色方案对比特别快
- 角度组合可微调:想换角度顺序或加角度,改第 0 段指令里的角度列表即可,三个角度最稳