位置:首页 > 技术资讯 > MiniMax M3模型正式发布 自研MSA稀疏注意力架构全解析

MiniMax M3模型正式发布 自研MSA稀疏注意力架构全解析

时间:2026-07-24  |  作者:318050  |  阅读:0

2026年6月1日,国产AI大模型公司MiniMax正式推出了新一代通用模型——MiniMax M3

这个节点很有看头,因为官方给出了非常清晰的定位:

  • 编程与智能体能力方面实现代际突破;
  • 超长上下文处理方面实现代际突破;
  • 原生多模态理解方面实现代际突破。

用一句话概括:这是国内首个同时集齐“前沿Coding能力、1M超长上下文、原生多模态”这三项核心能力的大模型。目前,它也是全球唯一具备这样完整能力组合的开源选择

MiniMax M3正式发布:自研MSA稀疏注意力架构

核心引擎:自研MSA稀疏注意力架构

M3能实现这样的融合,底层依赖的是全新自研的MiniMax Sparse Attention(MSA)稀疏注意力架构。这才是它的核心引擎。

相比传统的全注意力机制,MSA最直接的优势是:大幅降低长上下文场景下的计算成本

它把上下文窗口直接拉到了100万token。这意味着什么?

  • 在处理超长文档时,可以在单次推理中保留完整信息链路;
  • 在处理复杂代码仓库时,不再需要分批次处理;
  • 在多轮任务协作场景下,效率和准确性都上了一个台阶。

实际测试表现:超越GPT-5.5和Gemini 3.1 Pro

在衡量编程能力的SWE-Bench Pro评测集上,M3的成绩超过了GPT-5.5和Gemini 3.1 Pro,逼近Opus 4.7的水平。

在另一个综合评估SVG生成性能的SVG-Bench基准上,M3直接超过了Opus 4.7。

这组数据,放在全球竞品里横向对比,含金量非常高

商业化路径:Token Plan订阅方案

MiniMax同步推出了Token Plan订阅方案,共三个档位,覆盖不同需求:

  • Plus版:每月49元,包含6亿token;
  • Max版:每月119元,包含18亿token;
  • Ultra版:每月469元,包含55亿token。

这个定价结构,基本是把门槛和天花板都摆在了台面上

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多