正文内容 评论(0)

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐
2026-10-03 07:16:58  出处:快科技 作者:红茶 编辑:红茶     评论(0)点击可以复制本篇文章的标题和链接复制对文章内容进行纠错纠错

快科技10月3日消息,据报道,AI云服务商CoreWeave近日宣布,英伟达Vera Rubin NVL72系统已在CoreWeave Cloud正式投入生产,AI软件公司Cognition成为首个在该平台运行生产工作负载的客户。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

Cognition在Vera Rubin NVL72上运行SWE-2推理任务,实测总Token吞吐量较GB200 NVL72提升高达4.8倍。在强化学习场景中,每GPU输出Token吞吐量也达到GB200 NVL72的3.8倍,意味着Devin可同时处理更多会话并加速多步推理。

每瓦性能同样大幅跃升。在DeepSeek-R1推理基准测试中,Vera Rubin NVL72每兆瓦Token吞吐量达到GB200 NVL72的10倍,在相同电力消耗下可产出更多智能输出。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

硬件规格方面,NVL72系统由36颗Vera CPU和72颗Rubin GPU构成,采用100%全液冷设计。无缆线模块化托盘设计将安装时间从两小时压缩至五分钟,大幅提升部署效率。

除GPU系统外,CoreWeave还将Vera CPU作为独立计算层提供给客户。单机架部署128颗Vera CPU、总计11264核,可支持超过11000个并发隔离环境,智能体沙箱启动速度比x86 CPU快3倍以上。

CoreWeave同步推出Forge开发环境,将Weights & Biases、OpenPipe等工具整合为统一开发层,覆盖实验追踪、模型评估与生产部署全流程。

英伟达超大规模与高性能计算副总裁Ian Buck表示,CoreWeave的V100 GPU至今仍在运行客户工作负载,而Vera Rubin NVL72已进入生产,这体现了英伟达平台跨代持续创造价值的长期能力。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

【本文结束】如需转载请务必注明出处:快科技

责任编辑:红茶

文章内容举报

  • 支持打赏
  • 支持0人

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...