商城首页欢迎来到中国正版软件门户

您的位置: 首页 > 文章列表 > 硬件相关 > OpenAI研究员盛赞AMD联合AI推理方案:表现“令人难以置信”

OpenAI研究员盛赞AMD联合AI推理方案:表现“令人难以置信”

  发布于2026-07-29 阅读(0)

扫一扫,手机访问

最近,科技媒体 Wccftech 曝出一条消息,在 AI 圈子里引起了不小的关注:OpenAI 的研究员 Jeffrey Wang 公开称赞 AMD 和 Cerebras 联手打造的 AI 推理解决方案,用了“令人难以置信”这个评价。能从一个头部 AI 公司的研究员嘴里听到这种话,分量可想而知。

这套方案瞄准的是超低延迟 AI 推理场景,说白了就是让模型响应得像闪电一样快。它把 AMD 的 Helios 机架级方案和 Cerebras 的晶圆级引擎揉在一起,摆明了是要跟英伟达和 Groq 的组合一较高下。按照双方公开的路线图,Helios 机架扮演的是高性能、可扩展的吞吐引擎,专门负责处理提示词和超长上下文窗口。而 Cerebras 的 Wafer-Scale Engine 则扛起另一块硬骨头——对内存带宽要求极高的 Token 生成和解码环节,主打超低时延。两个引擎配合起来,每瓦每秒能处理的 token 数量预计能提升 5 倍。



Jeffrey Wang 还透露了更多细节。他提到,OpenAI 内部已经在 Cerebras 芯片上跑起来了某些模型,效果相当出色,推理速度让人眼前一亮。他举了个例子:以前做个任务可能要等上几分钟,现在切换任务的瞬间,结果就出来了,效率提升肉眼可见。

我们内部在 Cerebras 芯片上运行某些 OpenAI 模型,表现非常出色,其推理速度非常亮眼。 对于我们日常工作而言,以前我可能需要等待几分钟才能完成一项任务,而现在切换任务的瞬间,该任务就已经完成了,这大大提高了我们的工作效率。


本文转载于:https://www.163.com/dy/article/L30DB5CB0511B8LM.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。

热门关注