英伟达GB300再破世界纪录!256块GPU跑DeepSeek-v3:算力提升50%
时间:2026-07-22 | 作者: | 阅读:07月22日消息,英伟达宣布Blackwell GB300刷新MoE预训练世界纪录。使用256块GPU训练DeepSeek-v3 671B模型,每GPU吞吐达1648 TFLOPs。
相比去年11月的1088 TFLOPs,GB300性能优化提升50%。与上一代GB200的606 TFLOPs相比,实现了约3倍的性能跃升。
这一成绩来之不易。英伟达在过去6个多月模拟了超过25万种配置,为Blackwell摸索出38项重大优化方案,累计进行了140万小时的GPU测试。
需要提及的是,MoE即混合专家模型,将大模型分割为多个专家子网络。每次推理或训练仅激活其中一部分,以更低计算成本实现更大模型容量,是当前大语言模型的主流架构。
GB300 NVL72用更少的GPU硬件就达到相同训练性能。这意味着AI训练成本将进一步下降,对大模型厂商是实实在在的利好。
英伟达表示通过系统级优化的持续挖掘,Blackwell架构仍有性能提升空间。这轮优化成果将直接惠及所有使用GB300的AI训练集群。
对DeepSeek这类大模型厂商而言,GB300带来的算力提升意味着更短训练周期和更低成本。1648 TFLOPs的单GPU算力足以支撑更大规模模型的快速迭代。
来源:https://news.mydrivers.com/1/1138/1138250.htm
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 中国智能投影依旧“能用就行”:近6成买家选500流明以下
- 时间:2026-07-25
-
- 投影没人买了!2026上半年中国市场大跌近三成:Q2创5年新低
- 时间:2026-07-25
-
- 吃灰老卡再战三年!大神魔改P100显卡:跑35B大模型提速88%
- 时间:2026-07-24
-
- RTX 3060 12GB越老越香!三年后竟反超RTX 4060和RX 7600
- 时间:2026-07-24
-
- 顶着战火也要抢2nm!以色列AI局长喊话台积电三星英特尔:快来建晶圆厂
- 时间:2026-07-24
-
- 近十年最帅风冷!酷冷至尊V8 ACE 3DHP散热器评测:单塔能干翻双塔
- 时间:2026-07-24
-
- NVIDIA最深的护城河要凉!AMD放言:CUDA已不值一提
- 时间:2026-07-24
-
- AMD全新X100系列芯片发布:16核Zen 5+10年寿命
- 时间:2026-07-24
精选合集
更多大家都在玩
热门话题
大家都在看
更多-
- iOS 13.5.1电池续航差是电池耗电问题吗
- 时间:2026-07-25
-
- 苹果教育优惠开启 附购买攻略
- 时间:2026-07-25
-
- 苹果iOS 14 beta 2 测试版主要更新内容:除细节变化外修复多项Bug
- 时间:2026-07-25
-
- iOS 14 beta 2 是否解决内存占用过多问题?
- 时间:2026-07-25
-
- 受欢迎的奥特曼游戏有哪些
- 时间:2026-07-25
-
- iOS 14信息应用5大更新变化
- 时间:2026-07-25
-
- iOS 14正式版上线时间公布 官方全新介绍
- 时间:2026-07-25
-
- 最新苹果iOS 14 Beta 2版本更新内容全解析与升级教程
- 时间:2026-07-25



