英伟达官宣新GPU Rubin CPX
多达128GB显存、推理性能高达百万token
2025-09-10
来源:快科技
9月10日消息,128GB显存的RTX 5090是没有的,不过128GB显存的AI GPU确实有。
我们知道,NVIDIA下一代GPU架构代号“Rubin”,明年才会正式登场。
但是现在,NVIDIA官方宣布了“Rubin CPX”,一款专门面向长窗口AI推理、智能体工作负载而打造的上下文处理型GPU。
它基于Rubin架构,单芯片设计,CUDA核心数量没公布,只是说配备四个NVENC编码器、四个NVDEC解码器用于视频工作流,搭配128GB GDDR7显存。
NVIDIA宣称,它在NVFP4数据精度下,计算性能最高30 PFlops(每秒3亿亿次),可以实现百万级token的推理。
同时,在长上下文处理场景下,它的注意力性能相比GB300 NVL72提升了最高3倍。
Rubin CPX今天只是纸面宣布,正式推出要等到2026年底——你没看错,是明年底。
NVIDIA日前透露,下代Rubin GPU、Vera CPU都已经在台积电完成流片,符合预期。


本站内容除特别声明的原创文章之外,转载内容只为传递更多信息,并不代表本网站赞同其观点。转载的所有的文章、图片、音/视频文件等资料的版权归版权所有权人所有。本站采用的非本站原创文章及图片等内容无法一一联系确认版权者。如涉及作品内容、版权和其它问题,请及时通过电子邮件或电话通知我们,以便迅速采取适当措施,避免给双方造成不必要的经济损失。联系电话:010-82306118;邮箱:aet@chinaaet.com。
