正文内容 评论(0

英伟达偷偷重启Rubin CPX芯片!郭明錤曝五大变革:专攻百万Token推理、成本大降
2026-09-01 14:59:54  出处:快科技 作者:红茶 编辑:红茶     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

快科技9月1日消息,天风国际证券分析师郭明錤近日发布的最新产业调查显示,英伟达已重启Rubin CPX芯片计划,预计2027年第一季度正式投产。

这款专为大规模长上下文AI推理与预填充阶段设计的全新GPU类别,最早于2025年GTC大会首次公开,原计划2026年底上市,后一度从产品蓝图中移除,如今重新回归。

据郭明錤报告,重启后的新版CPX在规格、机柜设计、互联架构、运作模式和产品定位五个维度均有重大调整,整体朝着更灵活、更具成本效益的方向演进。

CPX是为了处理百万级Token的预填充及长上下文推理而设计的,采用NVFP4精度技术,单颗GPU提供30至50 Petaflops运算效能。旧版CPX原定搭载128GB GDDR7内存,成本更低但算力有限。

重启后的新版CPX改用168GB HBM4内存,低于Rubin标准版的288GB HBM4,但大幅高于旧版的128GB GDDR7。此外,单颗GPU最高功耗同为2300W。

机柜设计方面,新版CPX采用独立MGX ETL机柜,不再与Rubin共柜。客户可根据需求配置64、128、192或256颗CPX。每64颗CPX组成一个机柜模组,配置8个运算托盘(每托盘8颗CPX)加1个交换机托盘。

互联架构上,NVLink仅用于同一托盘内8颗CPX的Scale-Up互联,每颗CPX的NVLink带宽为1至1.5TB/s,低于Rubin的3.6TB/s。同一机柜模组内的托盘间通过Spectrum-6以太网进行Scale-Out,跨机柜模组则通过OSFP光纤连接。

CPX需与Vera Rubin NVL72搭配使用,英伟达建议CPX与Rubin的比例为1:1。CPX负责处理预填充并建立KV Cache,再通过以太网RDMA传输给Rubin执行解码生成。

郭明錤指出,目前AI推理工作负载中超过一半来自处理输入内容并建立KV Cache,CPX以更灵活的部署方式和更低成本承接这一任务,每个运算托盘(8颗CPX)约配备1.34TB HBM4,足以支撑大多数长上下文预填充与KV Cache建立需求。

英伟达偷偷重启Rubin CPX芯片!郭明錤曝五大变革:专攻百万Token推理、成本大降

【本文结束】如需转载请务必注明出处:快科技

责任编辑:红茶

文章内容举报

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...