发布于2026-07-29 阅读(0)
扫一扫,手机访问
最近,科技媒体 Wccftech 曝出一条消息,在 AI 圈子里引起了不小的关注:OpenAI 的研究员 Jeffrey Wang 公开称赞 AMD 和 Cerebras 联手打造的 AI 推理解决方案,用了“令人难以置信”这个评价。能从一个头部 AI 公司的研究员嘴里听到这种话,分量可想而知。
这套方案瞄准的是超低延迟 AI 推理场景,说白了就是让模型响应得像闪电一样快。它把 AMD 的 Helios 机架级方案和 Cerebras 的晶圆级引擎揉在一起,摆明了是要跟英伟达和 Groq 的组合一较高下。按照双方公开的路线图,Helios 机架扮演的是高性能、可扩展的吞吐引擎,专门负责处理提示词和超长上下文窗口。而 Cerebras 的 Wafer-Scale Engine 则扛起另一块硬骨头——对内存带宽要求极高的 Token 生成和解码环节,主打超低时延。两个引擎配合起来,每瓦每秒能处理的 token 数量预计能提升 5 倍。


Jeffrey Wang 还透露了更多细节。他提到,OpenAI 内部已经在 Cerebras 芯片上跑起来了某些模型,效果相当出色,推理速度让人眼前一亮。他举了个例子:以前做个任务可能要等上几分钟,现在切换任务的瞬间,结果就出来了,效率提升肉眼可见。
我们内部在 Cerebras 芯片上运行某些 OpenAI 模型,表现非常出色,其推理速度非常亮眼。 对于我们日常工作而言,以前我可能需要等待几分钟才能完成一项任务,而现在切换任务的瞬间,该任务就已经完成了,这大大提高了我们的工作效率。

售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9