Pg官方电子科技——国产嵌入式CPU核心技术提供商

banner - PG电子「中国」官方网站 - PG官方平台门户网站

公司资讯 | PG电子新闻

MiniMax H3正式开源,十六家头部芯片厂商、开发社区同日适配

发布日期:2026-08-03 23:01:25 浏览数:3

8月3日,MiniMax H3模型正式开源。

MiniMax H3是一个通用型全模态生成系统pg电子赏金女王。它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。得益于以任务泛化为导向的系统设计,H3在预训练阶段便已具备广泛的多模态上下文理解与生成能力,因此能够出色地遵循复杂的多模态指令。

华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub、fal等开发社区和云推理平台,另有vLLM、SGLang等推理框架,均在H3开源同日完成了相关适配支持。

完整的H3系统由H3-Context-IR、H3-Base、H3-Regenerate-2K三个模块组成。开发者可以直接从Hugging Face下载MiniMax H3模型,H3-Base目前支持通过SGLang、vLLM、diffusers和ComfyUI等推理框架和工作流进行部署。

MiniMax H3支持文本、图片、音频和视频等多种输入形式,支持2K分辨率直出,可生成最长15秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。

在Artificial Analysis视频模型榜单中,MiniMax H3在视频编辑能力项排名全球第一。在模型效果方面,MiniMax H3具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。

自成立以来,MiniMax坚持文本与多模态模型并行自研,已先后开源三代 M 系列文本模型。H3则是 MiniMax推出的首款开源多模态生成模型。

H3借鉴了文本模型发展过程中已经被验证的方法,包括复杂问题拆解、Reasoning、Scaling Context和Muon优化器等,并将其应用到多模态理解、数据构建和模型训练中。围绕不同任务的理解和指令遵循,MiniMax对数据体系进行了多轮迭代,提升模型面对开放输入和复杂指令时的泛化能力。

MiniMax H3视频生成价格为0.8元/秒(2K分辨率),仅为业内同类旗舰视频模型的三分之一。MiniMax通过高压缩 Tokenizer降低视频生成所需的Token数量,实现了成本优化与效率的提升。针对视频长度、分辨率和多模态理解与生成负载差异较大的特点,MiniMax在异构训练、负载均衡和GPU利用效率等方面进行系统优化,在追求模型效果的同时控制训练和推理成本。

MiniMax H3将业内多模态模型的竞争进一步带向效果、成本、开放性与生态协同的综合维度,丰富了模型企业与国产AI芯片软硬件协同生态。与此同时,MiniMax多模态路线进入了模型能力、训练效率、开源生态和行业应用协同推进的新阶段。

“通过 MiniMax H3,我们希望为更多企业和开发者、创作者降低内容创作的门槛。企业可以在本地灵活部署,结合自身数据和业务进行优化,更好地满足安全合规要求;芯片厂商和开发者也能共同参与适配和优化,降低使用成本,扩大应用范围。”MiniMax相关负责人表示,“我们会持续推动优秀的文本、多模态模型从过往的封闭服务,走向更加开放、可协作的产业生态。”

相关新闻推荐阅读

了解PG电子更多资讯