商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > AMD携手Cerebras押注低时延AI推理

AMD携手Cerebras押注低时延AI推理

  发布于2026-07-24 阅读(0)

扫一扫,手机访问

在 Advancing AI 2026 活动上,AMD 和 Cerebras 正式走到了一起——双方联手打造了一套面向 AI 推理场景的解决方案,专门针对超低延迟需求。这可不是小打小闹,而是直接对标英伟达与 Groq 的合作组合。


根据最新披露的新闻稿,这套方案的核心思路是“分工协作”。AMD 的 Helios 机架级解决方案负责高性能、可扩展的吞吐引擎,主要处理提示词和大上下文窗口——说白了,就是先把大段输入吃进去、理解清楚。而 Cerebras 的晶圆级引擎(Wafer-Scale Engine)则专攻对内存带宽要求极高的 Token 生成与解码环节,强调的正是超低时延表现。


两个计算引擎协同作战,官方给出的预期是:每瓦每秒可以处理的 token 数量提升 5 倍。这个数字放在当前 AI 推理效率竞争白热化的背景下,分量不轻。



再说说 Cerebras 的独门武器。Wafer-Scale Engine 本质上是一块巨大的互连硅片,上面无缝集成了数十万个计算核心和数十 GB 的 SRAM。这种设计的最大好处是:大幅减少外部网络瓶颈对数据传输的影响——数据在芯片内部就能完成流转,不用频繁绕道外部接口,延迟自然就降下来了。

本文转载于:https://www.163.com/dy/article/L2K00SJ40511B8LM.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注