AMD与Cerebras联手发力低时延AI推理
AMD与Cerebras联合推出AI推理解决方案,采用分工协作架构:AMDHelios处理提示词与大上下文,Cerebras晶圆级引擎专攻超低时延token生成,每瓦每秒token处理量提升5倍,其集成数十万核心与SRAM的设计大幅减少外部网络瓶颈。
在 Advancing AI 2026 大会上,AMD 与 Cerebras 正式宣布达成合作,共同打造面向 AI 推理场景的联合解决方案,专注于满足超低延迟的苛刻需求。这一合作并非小规模尝试,而是直接对标英伟达与 Groq 的竞争组合。

根据最新公布的新闻稿,该方案的核心设计理念在于“分工协作”。AMD 的 Helios 机架级解决方案作为高性能、可扩展的吞吐引擎,主要负责处理提示词(Prompt)及大上下文窗口,即先对长段输入进行高效解析与理解。而 Cerebras 的晶圆级引擎(Wafer-Scale Engine)则专注于对内存带宽要求极高的 Token 生成与解码环节,突出其超低时延特性。

两个计算引擎协同工作,官方预期可实现每瓦每秒处理的 Token 数量提升 5 倍。这一数字在当前 AI 推理效率竞争日益激烈的背景下,具有重要分量。


此外,Cerebras 的独门技术——Wafer-Scale Engine,本质上是一块巨大的互连硅片,其上无缝集成了数十万个计算核心以及数十 GB 的 SRAM。这种设计最大的优势在于:大幅降低外部网络瓶颈对数据传输的影响——数据在芯片内部即可完成流转,无需频繁通过外部接口,从而显著降低延迟。
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
OpenAI加入签署AI开源模型公开信,组织达35家
7月25日,微软、英伟达等25家美国公司联署公开信支持开放权重AI模型,随后签署方增至35家,新增包括OpenAI等。开放权重模型可下载、修改、运行,能扩大创新、强化竞争并降低风险,避免AI收益集中于少数巨头。
上海低空全链条布局提速,总部制造基地与商业化落地
2026国际低空经济博览会展示御风未来M1空中医疗救护车验证机,与瑞金医院合作探索低空急救。上海集聚全国约半数eVTOL头部企业,覆盖全产业链。时的科技、沃兰特等将总部及制造基地落户上海,推动商业化场景落地。
海南全岛封关后首条跨省低空物流航线成功试飞
海南全岛封关后首条跨省低空物流航线试飞成功,标志着“桂琼低空智慧物流走廊”试点项目正式启动,实现了低空经济在跨省物流领域的实质性突破,对推动低空经济高质量发展具有里程碑意义。
四位菲尔兹奖得主三位说中文,美国数学家曾参加汉语桥
2026年菲尔兹奖四位获奖者中三位能流利使用中文,中国数学家王虹和邓煜实现中国籍获奖零的突破,美国数学家白杰文精通中文并曾参加“汉语桥”比赛。这一成就展现了中文在数学界的重要地位。
马斯克无聊公司新一轮融资估值大幅跃升至200亿美元
马斯克旗下隧道公司寻求新一轮融资,目标估值约200亿美元,拟募资40亿美元,较2024年估值翻两倍多。公司运营拉斯维加斯隧道网络,正推进纳什维尔和迪拜项目,但特斯拉、SpaceX近期表现不佳。
- 热门数据榜
相关攻略
2026-07-25 21:28
2026-07-25 21:27
2026-07-25 21:27
2026-07-25 21:27
2026-07-25 21:27
2026-07-25 21:27
2026-07-25 21:15
2026-07-25 21:14
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程

