MiniMax H3 是哪一家的?MiniMax出品公司介绍
MiniMax H3 是一款由MiniMax(稀宇科技) 研发并开源的通用全模态生成模型。它能统一理解文本、图像、视频和音频组成的多模态上下文,并生成最高 2K 分辨率、最长 15 秒、带有原生立体声音频的视频。本文简要介绍 MiniMax H3 的所属公司及基本信息。
一、所属公司:MiniMax(稀宇科技)
MiniMax H3 由MiniMax(稀宇科技) 公司发布。该公司成立于 2021 年 6 月,是中国"AI大模型六小龙"之一,并于 2025 年 1 月在香港联交所挂牌上市(股票代码:00100.HK)。
二、产品定位:首款开源多模态生成模型
MiniMax H3 是 MiniMax 推出的首款开源多模态生成模型。它标志着 MiniMax 从“特化任务模型”向“通用多模态智能”的重要迈进。H3 借鉴了文本模型的发展经验,在预训练阶段就具备了广泛的多模态上下文理解与生成能力。
三、核心能力与商业价值
根据官方介绍,MiniMax H3 具备商用级的多场景内容生成能力。它在指令遵循、文字与品牌信息呈现、视频到视频动作迁移(V2V Motion Transfer)等方面表现出色。模型广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。
在成本方面,H3 在 2K 分辨率下的每秒价格不到主流模型的三分之一。
四、开源与生态支持
MiniMax H3 于 2026 年 7 月 31 日发布,并在 8 月 3 日正式开源。开源当日即获得了华为昇腾、摩尔线程、沐曦股份、AMD、Intel 等国内外芯片厂商,以及 Hugging Face、魔搭 ModelScope、ComfyUI 等开发社区和云推理平台的支持。开发者可以直接从 Hugging Face 下载模型,并通过 SGLang、vLLM、diffusers 和 ComfyUI 等框架进行部署。
总结
MiniMax H3 由中国人工智能公司 MiniMax(稀宇科技) 研发并开源。作为其首款开源多模态生成模型,H3 具备商用级的全模态内容生成能力,支持文本、图像、视频和音频的输入,可输出最高 2K 分辨率、15 秒时长的音视频内容。该模型已获得广泛的芯片与平台生态支持。此外,实在Agent 已经内置了该模型,您可以在 Agent 工作流中直接调用 H3 的能力,无需额外配置。

