丁丁打折网 - 网友优惠券分享网站,有688999个用户

京东优惠券 小米有品优惠券

当前位置 : 首页>电脑数码>英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

类别:电脑数码 发布时间:2026-10-03 12:55

10月3日消息,据报道,AI云服务商CoreWeave近日宣布,英伟达Vera Rubin NVL72系统已在CoreWeave Cloud正式投入生产,AI软件公司Cognition成为首个在该平台运行生产工作负载的客户。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

Cognition在Vera Rubin NVL72上运行SWE-2推理任务,实测总Token吞吐量较GB200 NVL72提升高达4.8倍。在强化学习场景中,每GPU输出Token吞吐量也达到GB200 NVL72的3.8倍,意味着Devin可同时处理更多会话并加速多步推理。

每瓦性能同样大幅跃升。在DeepSeek-R1推理基准测试中,Vera Rubin NVL72每兆瓦Token吞吐量达到GB200 NVL72的10倍,在相同电力消耗下可产出更多智能输出。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

硬件规格方面,NVL72系统由36颗Vera CPU和72颗Rubin GPU构成,采用100%全液冷设计。无缆线模块化托盘设计将安装时间从两小时压缩至五分钟,大幅提升部署效率。

除GPU系统外,CoreWeave还将Vera CPU作为独立计算层提供给客户。单机架部署128颗Vera CPU、总计11264核,可支持超过11000个并发隔离环境,智能体沙箱启动速度比x86 CPU快3倍以上。

CoreWeave同步推出Forge开发环境,将Weights & Biases、OpenPipe等工具整合为统一开发层,覆盖实验追踪、模型评估与生产部署全流程。

英伟达超大规模与高性能计算副总裁Ian Buck表示,CoreWeave的V100 GPU至今仍在运行客户工作负载,而Vera Rubin NVL72已进入生产,这体现了英伟达平台跨代持续创造价值的长期能力。

英伟达新王炸投产!Vera Rubin NVL72跑出4.8倍Token吞吐

丁丁打折网©版权所有,未经许可严禁复制或镜像 ICP证: 湘ICP备2023003002号-11

Powered by 丁丁打折网本站为非营利性网站,本站内容均来自网络转载或网友提供,如有侵权或夸大不实请及时联系我们删除!本站不承担任何争议和法律责任!
技术支持:丁丁网 dddazhe@hotmail.com & 2010-2020 All rights reserved