2026-07-31 · AI 资讯
MiniMax发布全模态模型H3,主打极致性价比与模型开源

AI初创公司MiniMax今日正式发布其通用全模态生成模型MiniMax H3。该模型实现了文本、图像、视频及音频的统一理解与生成,标志着多模态模型从单一任务向通用助手的跨越。H3支持原生双声道音视频输出,单次可生成15秒的2K分辨率内容,在指令遵循及品牌呈现方面展现了商用级表现。
技术层面,H3采用了“上下文全模态表示”技术,利用自然语言作为连接各模态的桥梁。配合自研的H3-VAE与In-context Regeneration技术,该模型在2K分辨率下的生成成本显著低于主流模型,最高成本不到现有主流方案的三分之一,极大优化了性价比。
MiniMax官方同时宣布,将在未来几天内开源H3模型权重,这是国产视频大模型首次面向社区公开权重。此举不仅旨在推动国产芯片的适配与生态建设,也为国内企业降低多模态应用技术门槛提供了新路径。公司后续将持续推进Scaling扩展,进一步释放模型潜力。
