位置:首页 > 热点资讯 > DeepSeek R1 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s

DeepSeek R1 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s

时间:2026-07-24  |  作者:public.com?id=1284117&&https://www.ithome.com/0/974/422.htm  |  阅读:0

最新一轮AI推理性能测试中,英特尔的Arc Pro B70交出了一份相当抢眼的成绩单。7月8日,科技媒体Wccftech披露了蓝戟(GUNNIR)的实测数据:在DeepSeek R1模型推理表现上,这款显卡的吞吐量竟然超过了英伟达的RTX 5090D和RTX 4090D。

DeepSeek R1 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s

测试环境全部采用4卡配置,直接对比了三款显卡——Arc Pro B70 32GB、RTX 5090D 32GB与RTX 4090D 24GB——在AI大语言模型推理时的实际表现。模型选用的是DeepSeek R1-Distill Qwen 32B FP16,固定输入/输出长度为128个tokens,并发范围从1一直覆盖到512。核心指标是token/s吞吐量,说白了就是衡量大模型输出时的效率。

数据走势很有意思。并发低于32时,RTX 5090D稳坐第一,RTX 4090D紧随其后,Arc Pro B70表现与4090D相当。到了并发32和64,Arc Pro B70已经能追平甚至超过RTX 4090D。真正的转折点在并发128——此时Arc Pro B70的token吞吐量比RTX 5090D高出8.6%,比RTX 4090D高出34.2%。并发256时,差距进一步拉大:领先RTX 5090D 7.5%,领先RTX 4090D 48.7%。并发512的场景下,趋势保持一致。峰值吞吐量达到了惊人的2320.76 token/s。

换句话说,在高并发推理场景下,英特尔这张专业显卡的表现完全超出了预期——不仅压过了上一代旗舰,还把最新旗舰甩在了身后。这或许能给不少做AI部署的团队带来新的选型思路。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多