华体会官方注册

设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

AMD 携手 Cerebras 押注低时延 AI 推理:每瓦每秒 Token 吞吐提升 5 倍

2026/7/24 13:49:28 来源:IT之家 作者:故渊 责编:故渊

IT之家 7 月 24 日消息,科技媒体 Wccftech 今天(7 月 24 日)发布博文,报道称在 Advancing AI 2026 活动中,AMD 宣布携手 Cerebras 公司,联合开发 AI 推理解决方案。

根据官方新闻稿,该方案主要针对超低延迟 AI 推理场景,将整合 AMD 的 Helios 机架级解决方案与 Cerebras 的晶圆级引擎,从而应对英伟达和 Groq 合作。

按照双方披露的路线,Helios 机架承担高性能、可扩展吞吐引擎角色,主要处理提示词与大上下文窗口。

Cerebras 的 Wafer-Scale Engine 则负责对内存带宽要求更高的 Token 生成与解码环节,强调超低时延表现,结合使用 2 个计算引擎,预估可以将每瓦每秒 token 数量提高 5 倍。IT之家附上相关截图如下:

Cerebras 介绍称,Wafer-Scale Engine 在单块互连硅片上无缝连接数十万个计算核心和数十 GB 的 SRAM,减少外部网络瓶颈对数据传输的影响。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

华体会官方注册相关的文章

关键词:AMD

软媒旗下网站: IT之家 最会买 - 返利返现优惠券 Win7之家 Win10之家

软媒旗下软件: 软媒华体会官方注册-华体会(中国)APP应用 魔方