发布于2026-07-24 阅读(0)
扫一扫,手机访问
在 Advancing AI 2026 活动上,AMD 和 Cerebras 正式走到了一起——双方联手打造了一套面向 AI 推理场景的解决方案,专门针对超低延迟需求。这可不是小打小闹,而是直接对标英伟达与 Groq 的合作组合。

根据最新披露的新闻稿,这套方案的核心思路是“分工协作”。AMD 的 Helios 机架级解决方案负责高性能、可扩展的吞吐引擎,主要处理提示词和大上下文窗口——说白了,就是先把大段输入吃进去、理解清楚。而 Cerebras 的晶圆级引擎(Wafer-Scale Engine)则专攻对内存带宽要求极高的 Token 生成与解码环节,强调的正是超低时延表现。

两个计算引擎协同作战,官方给出的预期是:每瓦每秒可以处理的 token 数量提升 5 倍。这个数字放在当前 AI 推理效率竞争白热化的背景下,分量不轻。


再说说 Cerebras 的独门武器。Wafer-Scale Engine 本质上是一块巨大的互连硅片,上面无缝集成了数十万个计算核心和数十 GB 的 SRAM。这种设计的最大好处是:大幅减少外部网络瓶颈对数据传输的影响——数据在芯片内部就能完成流转,不用频繁绕道外部接口,延迟自然就降下来了。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9