位置:首页 > 技术资讯 > MiniMax新一代旗舰M3模型正式发布

MiniMax新一代旗舰M3模型正式发布

时间:2026-07-24  |  作者:318050  |  阅读:0

MiniMax M3 发布:国产大模型从跟随者变为规则定义者

MiniMax M3 的发布,让国产大模型在长上下文与智能体能力这条赛道上,终于从跟随者变成了规则的定义者。

作为国内首个同时将前沿 Coding 能力、1M 超长上下文和原生多模态集于一身的开源模型,M3 带来的不仅是一组亮眼的参数,更是一整套可供行业借鉴的技术范式。

MiniMax发布新一代旗舰M3

架构突破:自研稀疏注意力架构 MSA

支撑这三大能力的,是 MiniMax 自研的稀疏注意力架构——MSA。这套架构的逻辑其实并不复杂:当模型需要处理一个 Query 时,它不会像传统注意力机制那样逐一核对全局所有 Key-Value。

而是先通过一个轻量级的索引分支,在已切分成 Block 的百万级上下文中快速打分,只挑出相关性最高的少数几个 Block;再由稀疏分支对这些 Block 执行实际的注意力计算。

整条链路可以概括为两步:先索引,再计算。一句话:把注意力用在该用的地方。

性能飞跃:速度提升近10~15倍

数据说明了一切。在 100 万 tokens 的超长上下文场景下,M3 相比上一代 M2 模型,Prefill 阶段提速 9.7 倍,Decode 阶段提速 15.6 倍。单 Token 的计算量仅为 M2 的约二十分之一。

这意味着百万上下文不再是“能用但用不起”的摆设——推理效率的跃升,让长上下文真正成为可落地的能力。

更值得关注的是,相比 DeepSeek V4 的三层注意力混合结构,M3 仅用两阶段分块选择就实现了类似的稀疏效果,索引路径与计算路径清晰分离,工程实现也更为友好。

Redis 创始人 antirez 的评价很直白:这是“正确的道路”。在他看来,在本地推理场景下,稠密注意力的开销已经难以为继。

实际能力:多项评测超越 GPT-5.5 和 Opus 4.7

这种架构优势最终落在了实际能力上。在衡量编码能力的 SWE-Bench Pro 中,M3 超过了 GPT-5.5 和 Gemini 3.1 Pro,逼近 Opus 4.7。

在综合评估 SVG 生成性能的 SVG-Bench 上,M3 甚至超过了 Opus 4.7。在面向自主 Agent 的端到端评测框架 Claw-Eval 中,M3 拿下最高分。

在 BrowseComp 智能体评测中,M3 以 83.5 分超越 Opus 4.7 的 79.3 分。

MiniMax 还做了一个极具说服力的演示:他们丢给 M3 一篇 ICLR 2025 杰出论文,要求独立复现。

M3 连续运行近 12 小时,全程自主产出 18 次 commit 与 23 张实验图表,成功跑通核心实验。写出的代码可直接交付,而不是“能跑但需要人改”。这才是关键所在。

原生多模态:文本、图片、视频混合训练

多模态方面,M3 从训练起点就采用文本、图片、视频等多模态混合训练,是一个真正的原生多模态模型

MiniMax 在技术报告中特别强调,交错数据——即文本和图像等其他模态在序列中交替自然排列的数据——对模型性能的提升比一般人想象的更加关键。

为此,MiniMax 重构了整套数据管线,将预训练数据 Token 规模推至 100 万亿的量级。

M3 不仅支持图像与视频理解,还具备桌面操作能力,可在复杂跨应用环境中执行 Computer Use 任务。在多模态测试集 OmniDocBench 上,M3 得分超过 Gemini 3.1 Pro。

上下文窗口:1M tokens,保障 512K 可用

上下文窗口方面,M3 的 API 最高支持 1M tokens,并保障至少 512K tokens 可用。1M tokens 的概念大致相当于两本中文长篇小说的体量。

这意味着在处理长文档、复杂代码仓库、多轮任务协作等场景时,模型可以在一次推理中保留更完整的信息链路。长程 Agent 和长程 Coding,终于有了真正够用的基础设施。

M3 还即将在 HuggingFace 和 GitHub 上开源,支持私有集群部署和微调,兼容 Claude Code 等主流 Agent 框架及 MCP 协议。

模型规格:稀疏 MoE,兼顾能力与效率

模型规格上,M3 采用稀疏 MoE 架构,总参数约 196B 至 229.9B,但每个词元仅激活约 11B 参数,单请求最高支持 400 TPS。这种设计兼顾了能力与效率,让高性能模型不再意味着高门槛。

商业化方案:Token Plan 订阅与 API 定价

商业化方面,MiniMax 推出了 Token Plan 订阅方案:

  • Plus 版:每月 49 元,提供 6 亿 Token
  • Max 版:每月 119 元,提供 18 亿 Token
  • Ultra 版:每月 469 元,提供 55 亿 Token

API 定价上,上下文 512K 以内,标准版输入 2.1 元/百万 tokens,输出 8.4 元/百万 tokens,并提供 7 天限时五折优惠。

MiniMax 还为老套餐用户准备了迁移适应补偿,帮助平稳过渡到新的积分扣减体系。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多