本地一键部署 MiniMax H3,让文字和图片直接生成「带声音的视频」
AI星尘 Minimax-H3 整合包,开箱即用的本地 AI 视频生成环境。内置 MiniMax H3 全部模型(Int8 量化版)+ 完整 ComfyUI 环境 + 16 款精心调优的工作流,无需安装、无需配置,解压即用。
MiniMax H3 是什么
MiniMax H3 是 MiniMax 开源的最强音视频一体生成模型:生成的视频自带声音(对白、环境音、音效),并支持多参考图、多镜头导演台等电影级创作方式。配合 Qwen3-VL 32B 多模态语言模型,它能深刻理解你提供的每一张参考图。
16 款工作流,覆盖「生成 + 工具」全流程
🎬 H3 核心生成(8 款)
- H3 文生视频(官流 / 加速):一句话生成带声音的视频。官方标准流程 + Int8 量化加速版
- H3 单图生视频(官流 / 加速):一张图片让画面动起来,同样支持原生音频
- H3 多参考生视频(加速):最多 3 张参考图,多角色 / 多物体一致性控制
- H3 多参考多轨编辑:多轨视频与参考素材混合编辑,一站式成片
- H3 导演台全能(加速):电影级导演台,一个工作流完成多镜头运镜与叙事
- H3 多模态参考导演台:图片 + 文字多模态参考,导演台创作体验
🛠 素材工具链(8 款)
- SAM3 图像 / 视频抠图:高精度抠像,视频逐帧抠背景
- 简易抠图:一键快速抠图,日常够用
- SD-Pose 图像 / 视频多人检测:多人姿态骨架检测,构图分析利器
- Scail2 动作迁移:参考视频动作迁移,让角色复刻动作
- 视频插帧:AI 补帧,低帧率视频变丝滑
- Krea2 提示词增强 + 十种风格:一句话变专业提示词,十种风格路由选择
为什么选择 AI星尘整合包
- 🎵 音视频一体:对白、环境音、音效原生生成,告别后期配音,这是 H3 的独家优势
- 🧠 Qwen3-VL 32B 深度理解:多参考图保持角色、物体一致性,创作可控
- 🎬 导演台模式:多镜头叙事、运镜控制,一个人就是一支剧组
- ⚡ Int8 量化加速:显存要求更低、生成速度更快,16G 显存级别即可尝试
- 🔧 全工具链闭环:抠图 → 姿态检测 → 生成 → 动作迁移 → 插帧,素材处理到成片一条龙
- 📦 开箱即用:模型、环境、工作流全部内置,解压双击即启动
快速开始(3 步)
- 下载解压:购买后在个人中心「已购产品」获取下载链接,解压到任意目录(建议固态硬盘)
- 启动:双击 ComfyUI启动器.exe(或运行 run_nvidia_gpu.bat)
- 创作:打开「AI星尘-Minimax H3」目录下对应工作流,填入提示词 / 参考图,点击运行
重要说明
- 整合包总大小约 208GB(含全部模型),请确认磁盘空间与带宽后再购买
- NVIDIA 显卡 16GB 显存及以上可流畅运行(量化版),建议 32GB 内存
- 本包内置 H3 系列全部模型:ref2va / fl2va 量化版 UNet、Qwen3-VL 32B CLIP、视频 / 音频双 VAE,另含 Wan2.1-SCAIL2、SAM3、SD-Pose 等工具模型
常见问题
- 显存不够怎么办?优先使用带「加速」标注的工作流(Int8 量化版);生成分辨率调低可进一步降低占用
- 和「ComfyUI 整合包 V10.0」有什么区别?V10.0 是全能包(图像 / 视频 / 音频全领域),本包是 Minimax H3 专精包——视频 + 音频生成能力更强、工具链更聚焦
- 生成的视频有声音吗?有。H3 原生生成音视频一体结果,对白与音效可直接使用
- 会更新吗?会,随 H3 生态持续补充新工作流与模型优化
免责声明:本整合包基于开源项目(ComfyUI、MiniMax H3、Wan2.1 等)制作,仅供个人学习和研究使用,请遵守相关开源协议。





