位置:首页 > 综合教程 > AMD携手Cerebras发力低延迟AI推理 每瓦吞吐量提升5倍

AMD携手Cerebras发力低延迟AI推理 每瓦吞吐量提升5倍

时间:2026-07-25  |  作者:318050  |  阅读:0

7月24日,科技媒体Wccftech传来一个消息。

在Advancing AI 2026活动上,AMD正式宣布与Cerebras公司联手,共同打造AI推理解决方案。

AMD 携手 Cerebras 押注低时延 AI 推理:每瓦每秒 Token 吞吐提升 5 倍

根据最新新闻稿,这次合作瞄准的是超低延迟AI推理场景。

双方给出的方案是:把AMD的Helios机架级解决方案与Cerebras的晶圆级引擎整合在一起,直接对标英伟达和Groq的联手布局。

合作如何分工?

从技术细节来看,Helios机架扮演的是高性能、可扩展吞吐引擎的角色。它主攻提示词处理和大上下文窗口。

Cerebras的Wafer-Scale Engine则负责对内存带宽要求更高的Token生成与解码环节。其核心亮点是超低时延表现。

两个计算引擎配合使用,预估能将每瓦每秒的Token数量提升整整5倍

这才是真正的关键价值所在——效率翻倍,功耗却不增反降。

附上官方截图,方便大家直观感受。

Cerebras官方介绍称,Wafer-Scale Engine在单块互连硅片上,无缝集成了数十万个计算核心和数十GB的SRAM。

这样的设计,直接免去了外部网络瓶颈带来的数据传输延迟。效率上的优势不言而喻。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多