17173 > 游戏资讯 > 科技新闻 > 正文

英伟达偷偷重启Rubin CPX芯片!郭明錤曝五大变革:专攻百万Token推理、成本大降

2026-09-01 16:06:11 神评论
17173 新闻导语

英伟达重启Rubin CPX芯片!郭明錤曝五大变革,专攻百万Token推理,成本大降,2027年投产,性能大幅提升,点击了解详情。

天风国际证券分析师郭明錤近日发布的最新产业调查显示,英伟达已重启Rubin CPX芯片计划,预计2027年第一季度正式投产。

这款专为大规模长上下文AI推理与预填充阶段设计的全新GPU类别,最早于2025年GTC大会首次公开,原计划2026年底上市,后一度从产品蓝图中移除,如今重新回归。

据郭明錤报告,重启后的新版CPX在规格、机柜设计、互联架构、运作模式和产品定位五个维度均有重大调整,整体朝着更灵活、更具成本效益的方向演进。

CPX是为了处理百万级Token的预填充及长上下文推理而设计的,采用NVFP4精度技术,单颗GPU提供30至50 Petaflops运算效能。旧版CPX原定搭载128GB GDDR7内存,成本更低但算力有限。

重启后的新版CPX改用168GB HBM4内存,低于Rubin标准版的288GB HBM4,但大幅高于旧版的128GB GDDR7。此外,单颗GPU最高功耗同为2300W。

机柜设计方面,新版CPX采用独立MGX ETL机柜,不再与Rubin共柜。客户可根据需求配置64、128、192或256颗CPX。每64颗CPX组成一个机柜模组,配置8个运算托盘(每托盘8颗CPX)加1个交换机托盘。

互联架构上,NVLink仅用于同一托盘内8颗CPX的Scale-Up互联,每颗CPX的NVLink带宽为1至1.5TB/s,低于Rubin的3.6TB/s。同一机柜模组内的托盘间通过Spectrum-6以太网进行Scale-Out,跨机柜模组则通过OSFP光纤连接。

CPX需与Vera Rubin NVL72搭配使用,英伟达建议CPX与Rubin的比例为1:1。CPX负责处理预填充并建立KV Cache,再通过以太网RDMA传输给Rubin执行解码生成。

郭明錤指出,目前AI推理工作负载中超过一半来自处理输入内容并建立KV Cache,CPX以更灵活的部署方式和更低成本承接这一任务,每个运算托盘(8颗CPX)约配备1.34TB HBM4,足以支撑大多数长上下文预填充与KV Cache建立需求。

【来源:快科技】
关于英伟达,Rubin CPX,芯片,AI推理,GPU,HBM4,预填充,KV Cache,NVLink,郭明錤的新闻