NVIDIA官宣新GPU Rubin CPX!多达128GB显存、推理性能高达百万token

9月10日消息,128GB显存的RTX 5090是没有的,不过128GB显存的AI GPU确实有。
我们知道,NVIDIA下一代GPU架构代号“Rubin”,明年才会正式登场。
但是现在,NVIDIA最新宣布了“Rubin CPX”,一款专门面向长窗口AI推理、智能体工作负载而打造的上下文处理型GPU。
它基于Rubin架构,单芯片设计,CUDA核心数量没公布,只是说配备四个NVENC编码器、四个NVDEC解码器用于视频工作流,搭配128GB GDDR7显存。
NVIDIA宣称,它在NVFP4数据精度下,计算性能最高30 PFlops(每秒3亿亿次),可以实现百万级token的推理。
同时,在长上下文处理场景下,它的注意力性能相比GB300 NVL72提升了最高3倍。
Rubin CPX今天只是纸面宣布,正式推出要等到2026年底——你没看错,是明年底。
NVIDIA日前透露,下代Rubin GPU、Vera CPU都已经在台积电完成流片,符合预期。
免责声明
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
雷军引领小米五年逆袭:从低谷到破局的蜕变之路
北京国家会议中心内,雷军完成了第六场年度公开演讲,主题定为“改变”。这场持续超过两小时的分享,不仅回顾了小米过去五年的战略转型,更通过芯片研发、汽车业务突破等案例,展现了这家科技企业从“顺势而为”到
全球存储峰会探讨AI应用创新,驱动产业发展新方向
近日,由深圳市存储器行业协会与北京大学集成电路学院联合主办、爱集微协办的第四届GMIF全球存储器行业创新峰会在深圳成功举办。本届峰会以“AI应用,创新赋能”为主题,吸引了全球存储产业链上下游企业代表
富士康郑州园区如何满足数十万员工餐饮需求
全球最大的智能终端生产基地——富士康郑州综保园区,正以独特的“美食密码”激活数十万员工的生产力。当记者走进这座超级工厂,扑面而来的是跨越南北的烟火气:9大餐厅、200余个档口构成的美食矩阵,将河南烩
高通推骁龙X2 Elite与8至尊版芯片,AI性能再升级
高通在芯片领域再掀波澜,一口气推出两款堪称“全球最快”的处理器——面向PC端的骁龙X2 Elite系列,以及面向移动端的第五代骁龙8至尊版移动平台。这两款新品不仅在性能上实现跨越式突破,更将智能体A
真我GT8 Pro首发京东方2K 144Hz屏,骁龙8至尊版十月登场
realme 真我品牌近日动作频频,旗下即将发布的 GT8 Pro 手机引发市场高度关注。根据最新披露的信息,这款新机将率先搭载第五代骁龙 8 至尊版处理器,并配备电竞独显芯片 R1,性能表现值得期
相关攻略
热门教程
更多- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程


















