英伟达发布Vera Rubin平台进展:CoreWeave测试显示单位功耗Token吞吐提升10倍
2026年07月21日 23:53
来源: 界面新闻
东方财富APP

方便,快捷

手机查看财经快讯

专业,丰富

一手掌握市场脉搏

手机上阅读文章

提示:

微信扫一扫

分享到您的

朋友圈

K图 NVDA_0

  英伟达7月21日宣布,面向“千兆级AI工厂”的Vera Rubin平台正在全球扩大部署,CoreWeave、谷歌云、微软Azure和甲骨文云等已开始采用Vera Rubin NVL72系统。

  英伟达称,CoreWeave测试显示,Vera Rubin NVL72相比Grace Blackwell NVL72,每兆瓦可实现10倍Token吞吐提升。该平台整合Vera CPU、Rubin GPU、NVLink 6、ConnectX-9 SuperNIC、BlueField-4 DPU及Spectrum-6交换系统,旨在提升AI训练和推理效率。

  英伟达表示,Vera Rubin已覆盖全球350多个工厂节点、30个国家,目标是降低AI基础设施成本并提高能源利用效率。

  相关报道

  英伟达详解下一代AI专用Vera CPU 称速度是其他CPU的两倍多

  英伟达发文称,DeepInfra的基准测试结果显示,NVIDIA Vera CPU的速度是其他CPU的两倍多,并且能够支持更多并发的AI代理。云平台DeepInfra是NVIDIA开放AI生态系统的早期体验参与者,独立设计并运行了基于其生产型AI代理基础设施的基准测试。DeepInfra每周处理近五万亿个代币,其中约30%由代理系统驱动。其云平台专为高通量AI推理而建。基准测试显示,在相同服务质量下,支持最多1.6倍的并发AI代理,协同速度高达2.2倍,同时提升基础设施利用率和成本效益。这些结果表明,NVIDIA Vera CPU 能够实现生产代理人工智能所需的成本效益、低延迟和吞吐量。 随着AI代理承担更复杂的推理、规划、工具使用和数据流动,CPU性能在围绕每次模型调用的协调工作中变得越来越重要。作为英伟达对AI工厂极端联合设计策略的一部分,Vera CPU专为代理性工作负载设计。DeepInfra的基准测试强调了NVIDIA Vera CPU如何帮助云服务提供商提升基础设施利用率、提高成本效率,并在相同服务质量下支持更多并发的AI代理。

(文章来源:界面新闻)

文章来源:界面新闻 责任编辑:156
原标题:英伟达发布Vera Rubin平台进展:CoreWeave测试显示单位功耗Token吞吐提升10倍
郑重声明:东方财富发布此内容旨在传播更多信息,与本站立场无关,不构成投资建议。据此操作,风险自担。
举报
分享到微信朋友圈

打开微信,

点击底部的“发现”

使用“扫一扫”

即可将网页分享至朋友圈

扫描二维码关注

东方财富官网微信


扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500