京ICP备2022018928号-30 投诉举报:315 541 185@qq.com
(相关资料图)
IT之家 7 月 29 日消息,科技媒体 Wccftech 昨日(7 月 28 日)发布博文,报道称 OpenAI 公司研究员 Jeffrey Wang 指出,AMD 携手 Cerebras 公司联合开发 AI 推理解决方案表现“令人难以置信”。
IT之家此前报道,该解决方案主要针对超低延迟 AI 推理场景,将整合 AMD 的 Helios 机架级解决方案与 Cerebras 的晶圆级引擎,从而应对英伟达和 Groq 合作。
按照双方披露的路线,Helios 机架承担高性能、可扩展吞吐引擎角色,主要处理提示词与大上下文窗口。
Cerebras 的 Wafer-Scale Engine 则负责对内存带宽要求更高的 Token 生成与解码环节,强调超低时延表现,结合使用 2 个计算引擎,预估可以将每瓦每秒 token 数量提高 5 倍。
OpenAI 的研究员 Jeffrey Wang 高度评价 AMD 联合开发的 AI 推理解决方案,表示: