MiniMax H3开源一周衍生近300个模型,ComfyUI版下载量近700万
MiniMax H3开源满一周衍生近300个模型,ComfyUI版下载量近700万,英伟达团队4.5小时完成首轮推理优化。
8月13日,MiniMax(00100.HK)披露,其新一代全模态生成模型H3开源已满一周。据观点网报道,H3在AI与机器学习开源社区平台Hugging Face的热度持续排名前列,已衍生出接近300个模型,ComfyUI版本下载量接近700万;英伟达(NVDA.US)研究团队更在开源首日使用Sol Engine,于4.5小时内完成了首轮推理优化。这份亮眼的一周成绩单,让H3迅速跻身全球最受关注的开源权重模型之列。
开源一周:近300个衍生模型、近700万下载
MiniMax表示,H3模型开源至今一星期,在Hugging Face平台的热度持续排名前列。目前该模型已衍生出接近300个模型,ComfyUI版本下载量近700万。据媒体报道,H3已成为Hugging Face上采用速度最快的AI发布之一,有观点称其为“全球最被广泛采用的开放权重AI模型之一”。
H3于7月31日发布,8月3日正式开源。开发者可以直接从Hugging Face下载MiniMax H3模型,H3-Base目前支持通过SGLang、vLLM、diffusers和ComfyUI等推理框架和工作流进行部署,并支持多GPU并行推理。

全模态生成:视频编辑能力全球第一
MiniMax H3是一个通用型全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,并生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。在Artificial Analysis榜单中,其音频视频编辑能力排名全球第一,Elo评分达1130分,领先Gemini Omni Flash、Wan 2.7等国内外视频模型。
据介绍,完整的H3系统由H3-Context-IR、H3-Base、H3-Regenerate-2K三个模块组成。其中H3-Base负责实际的音视频生成,可输出24FPS帧率、32kHz立体声音频,稳定支持中英日韩法德等11种语言;H3-Regenerate-2K则结合原始上下文对768p视频进行再生成,以还原小文字、精细纹理等信息。

生态适配:16家伙伴Day 0支持,破解显存难题
H3开源同一天,华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub、fal等开发社区和云推理平台,另有vLLM-Omni、SGLang等推理框架,共16家生态伙伴完成了相关适配支持。
MiniMax指出,H3模型开放部分约有60B参数,BF16权重约需要120GB内存,远超大多数消费级GPU的显存。开源后,社区积极优化推理效率与硬件适配,让H3有机会在更多开发者的设备上运行。针对英伟达Blackwell GPU优化的NVFP4检查点格式,也进一步降低了内存需求,在缩小显存占用的同时保持精度。

英伟达团队4.5小时完成首轮推理优化
在社区优化浪潮中,英伟达研究团队的动作尤为亮眼。据报道,英伟达团队于H3开源首日使用Sol Engine,在4.5小时内就完成了首轮推理优化,展现出开源社区与硬件厂商协同的高效率。这一速度印证了开源模式在推动模型落地上的价值——从模型发布到硬件适配、再到推理效率提升,往往只需数天甚至数小时。
从近300个衍生模型到近700万次ComfyUI下载,MiniMax H3用一周时间证明了开源全模态模型的生命力。当约60B参数的开放权重遇上社区的量化和推理优化,原本“远超消费级显存”的庞然大物得以走进更多开发者的设备。H3的走红既是模型能力的胜利,更是开源生态协作的胜利——英伟达4.5小时的首轮优化、16家伙伴的Day 0适配,都在为“开放共赢”写下注脚。对于国产大模型而言,H3的开源热或许也在提示:让能力真正流动起来,才是生态竞争的关键胜负手。

信息来源:观点网《MiniMax H3开源一周衍生近300个模型》https://www.guandian.cn/article/20260813/584589.html;智东西/36氪《MiniMax H3正式开源,开发者可直接从Hugging Face下载》;时代财经/腾讯新闻;AASTOCKS财经新闻。
信息来源:观点网