英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐
  • 红茶
  • 2026年10月03日 07:16
  • 0

快科技10月3日消息,据报道,AI云服务商CoreWeave近日宣布,英伟达Vera Rubin NVL72系统已在CoreWeave Cloud正式投入生产,AI软件公司Cognition成为首个在该平台运行生产工作负载的客户。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

Cognition在Vera Rubin NVL72上运行SWE-2推理任务,实测总Token吞吐量较GB200 NVL72提升高达4.8倍。在强化学习场景中,每GPU输出Token吞吐量也达到GB200 NVL72的3.8倍,意味着Devin可同时处理更多会话并加速多步推理。

每瓦性能同样大幅跃升。在DeepSeek-R1推理基准测试中,Vera Rubin NVL72每兆瓦Token吞吐量达到GB200 NVL72的10倍,在相同电力消耗下可产出更多智能输出。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

硬件规格方面,NVL72系统由36颗Vera CPU和72颗Rubin GPU构成,采用100%全液冷设计。无缆线模块化托盘设计将安装时间从两小时压缩至五分钟,大幅提升部署效率。

除GPU系统外,CoreWeave还将Vera CPU作为独立计算层提供给客户。单机架部署128颗Vera CPU、总计11264核,可支持超过11000个并发隔离环境,智能体沙箱启动速度比x86 CPU快3倍以上。

CoreWeave同步推出Forge开发环境,将Weights & Biases、OpenPipe等工具整合为统一开发层,覆盖实验追踪、模型评估与生产部署全流程。

英伟达超大规模与高性能计算副总裁Ian Buck表示,CoreWeave的V100 GPU至今仍在运行客户工作负载,而Vera Rubin NVL72已进入生产,这体现了英伟达平台跨代持续创造价值的长期能力。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

文章纠错

  • 好文点赞
  • 水文反对

此文章为快科技原创文章,快科技网站保留文章图片及文字内容版权,如需转载此文章请注明出处:快科技

观点发布 网站评论、账号管理说明
热门评论
查看全部评论
相关报道

最热文章排行查看排行详情

邮件订阅

评论0 | 点赞0| 分享0 | 收藏0