商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > AI 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s 超英伟达 RTX 5090D

AI 推理测试:英特尔 Arc Pro B70 显卡吞吐最高 2320.76 token/s 超英伟达 RTX 5090D

  发布于2026-08-15 阅读(0)

扫一扫,手机访问

科技媒体 Wccftech 昨天(7 月 8 日)放出了一条有意思的测试结果:显卡厂商蓝戟(GUNNIR)手里那款英特尔 Arc Pro B70 GPU,在 DeepSeek R1 模型推理这块,居然把英伟达的 RTX 5090D 和 RTX 4090D 都甩在了身后。

测试配置是四张显卡同台竞技,核心抓的是英特尔 Arc Pro B70 32GB、英伟达 RTX 5090D 32GB 与 RTX 4090D 24GB 这三款显卡在 AI 大语言模型推理上的表现。模型选的是 DeepSeek R1-Distill Qwen 32B FP16,固定输入输出长度 128 个 tokens,并发范围从 1 一直拉到 512。核心指标就一个:token/s 吞吐量,说白了就是大模型往外吐字的速度。

结果挺有意思——并发低于 32 的时候,RTX 5090D 稳稳领先,RTX 4090D 跟在后面,Arc Pro B70 的表现和 RTX 4090D 基本持平;但到了并发 32 和 64,Arc Pro B70 已经能追平甚至超过 RTX 4090D 了。等并发冲到 128,Arc Pro B70 的 token 吞吐量比 RTX 5090D 高了 8.6%,比 RTX 4090D 高了 34.2%。并发到 256 时,领先幅度分别是 7.5% 和 48.7%。到了 512 并发,情况也差不多。

看数据更直观:Arc Pro B70 的 Tokens 吞吐量峰值达到了每秒 2320.76 个 Token,这速度在同类显卡里相当抢眼。

本文转载于:https://www.itren.com/digital/187994.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注