NVIDIA Vera Rubin 提升每瓦性能,為全球合作伙伴實(shí)現(xiàn)最低 Token 成本
在全球 300 多家合作伙伴的支持下Vera Rubin 正加速在全球范圍內(nèi)擴(kuò)大部署。CoreWeave、Google Cloud、Microsoft Azure 和 Mistral 等 NVIDIA 合作伙伴正紛紛部署 Vera Rubin該平臺(tái)在每瓦性能和最低 Token 成本方面樹(shù)立了基準(zhǔn)測(cè)試的新標(biāo)桿。NVIDIA Vera Rubin 正式登場(chǎng)正邁向十億瓦級(jí)規(guī)模部署。Vera Rubin NVL72 的量產(chǎn)正全面加速CoreWeave、Google Cloud、Microsoft Azure 和 Oracle Cloud Infrastructure 等合作伙伴的機(jī)架已投入運(yùn)行。Vera Rubin 的供應(yīng)鏈覆蓋 30 個(gè)國(guó)家的 350 多家工廠擁有迄今為止規(guī)模最大、最成熟的機(jī)架級(jí)供應(yīng)鏈旨在全面滿足客戶的算力需求。Vera Rubin 平臺(tái)從芯片到電網(wǎng)進(jìn)行了全棧協(xié)同設(shè)計(jì)旨在提供最高的每瓦性能和最低的 Token 成本。CoreWeave 針對(duì) DeepSeek-R1 的首次基準(zhǔn)測(cè)試結(jié)果充分證明了這一點(diǎn)其每兆瓦吞吐量比 Grace Blackwell NVL72 提升了 10 倍——這直接切中了電力受限的 AI 工廠最關(guān)心的核心指標(biāo)。通過(guò)極致協(xié)同設(shè)計(jì)提升性能取得這一突破的關(guān)鍵在于七款芯片和五種機(jī)架托盤之間的極致協(xié)同設(shè)計(jì)。五種機(jī)架系統(tǒng)包括 Vera Rubin NVL72、Vera CPU 機(jī)架、Groq 3 LPX、Spectrum-6 SPX 和 Vera BlueField-4 STX。它們被作為一個(gè)完整的系統(tǒng)進(jìn)行工程研發(fā)而非由通用產(chǎn)品簡(jiǎn)單拼湊而成。NVIDIA Vera CPU 正是其核心所在。它重新定義了“AI 工廠 CPU”應(yīng)有的形態(tài)。專為智能體時(shí)代設(shè)計(jì)其定制 Olympus 核心相較競(jìng)品的芯粒chiplet方案單線程性能提升 2 倍、核間帶寬提升 3 倍、內(nèi)存延遲降低 40%使其成為面向最關(guān)鍵智能體負(fù)載時(shí)最高效的單線程 CPU。以專屬定制網(wǎng)絡(luò)加速 AI 工廠建設(shè)在網(wǎng)絡(luò)方面該平臺(tái)的第六代 NVLink 縱向擴(kuò)展技術(shù)在處理復(fù)雜工作負(fù)載時(shí)相比通用以太網(wǎng)吞吐量提升超過(guò) 2 倍、延遲降低 1/3、數(shù)據(jù)包處理速率提升 10 倍。在橫向擴(kuò)展方面Spectrum-X 以太網(wǎng)集成 102.4T 的 Spectrum-6 交換機(jī)系統(tǒng)、1.6T 的 ConnectX-9 SuperNIC、自適應(yīng)路由、高級(jí)擁塞控制、遙測(cè)技術(shù)以及開(kāi)放的操作系統(tǒng)支持使其 RDMA 帶寬比通用以太網(wǎng)高出 1.6 倍。包括 CoreWeave、微軟、SpaceXAI 和 Tesla 在內(nèi)的全球領(lǐng)先的 AI 基礎(chǔ)設(shè)施建設(shè)者率先采用 Spectrum-6 交換機(jī)以加速其 AI 工廠的建設(shè)。此外采用 NVIDIA 光電一體化封裝CPO技術(shù)用于橫向擴(kuò)展這是全球首款實(shí)現(xiàn)量產(chǎn)的同類型交換機(jī)與傳統(tǒng)可插拔收發(fā)器相比其能效提升了 5 倍平均無(wú)故障間隔時(shí)間MTBI提升了 10 倍。CoreWeave、Lambda 和 OCI 率先采用該技術(shù)。Spectrum-XGS 以太網(wǎng)跨站點(diǎn)吞吐量提升 1.9 倍實(shí)現(xiàn)跨站點(diǎn)性能增強(qiáng)。滿足十億瓦級(jí) AI 工廠的建設(shè)不再局限于單一建筑的需求。同時(shí)NVLink Fusion 向第三方 XPU 開(kāi)放了 NVIDIA 基礎(chǔ)設(shè)施平臺(tái)為合作伙伴能夠借助成熟的 NVLink 縱向擴(kuò)展堆棧和生態(tài)系統(tǒng)實(shí)現(xiàn)產(chǎn)品的快速上市。節(jié)省部署時(shí)間節(jié)約水資源經(jīng)過(guò)三代機(jī)架級(jí)協(xié)同設(shè)計(jì)的迭代NVIDIA 打造出的 Vera Rubin NVL72 系統(tǒng)實(shí)現(xiàn)了托盤內(nèi)無(wú)電纜、無(wú)風(fēng)扇、無(wú)液冷軟管的極簡(jiǎn)設(shè)計(jì)將計(jì)算托盤的組裝時(shí)間從過(guò)去的數(shù)小時(shí)大幅縮短至僅需 1 分鐘。45 攝氏度的液冷進(jìn)水溫度設(shè)計(jì)使得系統(tǒng)無(wú)需冷水機(jī)組僅靠干式冷卻器即可運(yùn)行。對(duì)于新建的 AI 工廠而言這種高溫干式冷卻結(jié)合閉環(huán)液冷系統(tǒng)每兆瓦每年可節(jié)省數(shù)百萬(wàn)加侖的水資源。NVIDIA Vera Rubin驅(qū)動(dòng)歐洲開(kāi)放模型時(shí)代Vera Rubin 正為歐洲的 AI 基礎(chǔ)設(shè)施注入下一代性能。Vera Rubin 也是微軟與 Mistral 新一輪深化合作的基石。該合作將前沿 AI 帶到了歐洲把開(kāi)放的歐洲模型與云環(huán)境及客戶管理的環(huán)境相結(jié)合使各國(guó)政府和重點(diǎn)監(jiān)管行業(yè)能夠按照自身需求采用 AI 技術(shù)。Mistral 正在擴(kuò)充其 GPU 算力通過(guò)引入數(shù)千個(gè)最新的 NVIDIA Vera Rubin GPU增加面向客戶的 AI 算力供給并為訓(xùn)練、推理和大規(guī)模部署提供共享平臺(tái)。NVIDIA Vera Rubin 正邁入全面量產(chǎn)階段。這款機(jī)架級(jí) AI 超級(jí)計(jì)算機(jī)將七款協(xié)同設(shè)計(jì)的全新芯片整合為一個(gè)統(tǒng)一系統(tǒng)它將調(diào)用數(shù)萬(wàn)個(gè) GPU為新一代 Mistral Compute 和微軟歐洲的 AI 基礎(chǔ)設(shè)施提供動(dòng)力。打造真正適配當(dāng)?shù)卣Z(yǔ)言、文化與法規(guī)的 AI 不應(yīng)要求組織在創(chuàng)新、經(jīng)濟(jì)效益與控制權(quán)之間做出取舍。以 Vera Rubin 為計(jì)算基礎(chǔ)依托微軟和 Mistral 提供的自主云基礎(chǔ)設(shè)施與歐洲開(kāi)放模型歐洲完全可以三者兼得。CoreWeave 基準(zhǔn)測(cè)試顯示NVIDIA Vera Rubin 系統(tǒng)每兆瓦Token 吞吐量達(dá) Blackwell 的 10 倍通過(guò)與 NVIDIA 進(jìn)行極致的協(xié)同設(shè)計(jì)CoreWeave 正依托 Vera Rubin NVL72 實(shí)現(xiàn)數(shù)量級(jí)的性能躍升。與 CoreWeave 等合作伙伴的緊密協(xié)作對(duì)于將新一代 NVIDIA 加速計(jì)算成功部署至 AI 工廠至關(guān)重要。經(jīng)過(guò)數(shù)月的聯(lián)合工程研發(fā)CoreWeave 成為首家完成 Vera Rubin NVL72 部署與驗(yàn)證的 AI 云服務(wù)提供商——他們首次公布了基于實(shí)際運(yùn)行硬件測(cè)得的性能數(shù)據(jù)。CoreWeave 在 Vera Rubin NVL72 上運(yùn)行了 DeepSeek-R1 基準(zhǔn)測(cè)試。結(jié)果顯示與 Grace Blackwell NVL72 相比Vera Rubin NVL72 每兆瓦每秒 Token 吞吐量提升了 10 倍。每兆瓦 Token 吞吐量是決定 AI 基礎(chǔ)設(shè)施能否實(shí)現(xiàn)大規(guī)模盈利的核心指標(biāo)。每兆瓦產(chǎn)出的 Token 越多意味著在同等電力預(yù)算下能產(chǎn)出更多的智能算力或者在顯著降低功耗的情況下處理相同的工作負(fù)載。Jane Street 等 AI 實(shí)驗(yàn)室和企業(yè)將采用 Vera Rubin 平臺(tái)在 CoreWeave 云上擴(kuò)展其 AI 工廠。NVIDIA Vera Rubin 系統(tǒng)驅(qū)動(dòng)全新 Google Cloud A5X 實(shí)例助力 Ineffable Intelligence 發(fā)展NVIDIA Vera Rubin NVL72 正在為 Google Cloud 的首個(gè) A5X 實(shí)例提供算力支持該實(shí)例現(xiàn)已由倫敦初創(chuàng)公司 Ineffable Intelligence 率先采用。Ineffable Intelligence 致力于開(kāi)發(fā)新一代智能“Superlearner”系統(tǒng)該系統(tǒng)能夠通過(guò)經(jīng)驗(yàn)持續(xù)學(xué)習(xí)從而在各個(gè)領(lǐng)域?qū)崿F(xiàn)新的突破。NVIDIA Vera Rubin NVL72 專為這類智能體訓(xùn)練而設(shè)計(jì)能夠提供可預(yù)測(cè)的低延遲、高利用率以及遠(yuǎn)超上一代系統(tǒng)的單位智能算力產(chǎn)出。這使其成為大規(guī)模強(qiáng)化學(xué)習(xí)的理想平臺(tái)選擇。在 Google Cloud Next 上發(fā)布的 Google Cloud A5X 實(shí)例是基于 NVIDIA Vera Rubin NVL72 機(jī)架級(jí)系統(tǒng)構(gòu)建的裸金屬實(shí)例。與上一代相比其每 Token 推理成本降低至 1/10每兆瓦 Token 吞吐量提升了 10 倍。NVIDIA Vera CPU助力 DeepInfra AI 云實(shí)現(xiàn)編排速度翻倍DeepInfra 的基準(zhǔn)測(cè)試結(jié)果顯示NVIDIA Vera CPU 的運(yùn)行速度是其他 CPU 的 2 倍以上并且能夠支持更多并發(fā)的 AI 智能體。作為 NVIDIA 開(kāi)放 AI 生態(tài)系統(tǒng)的早期伙伴云平臺(tái) DeepInfra 基于其生產(chǎn)級(jí) AI 智能體基礎(chǔ)設(shè)施獨(dú)立設(shè)計(jì)并運(yùn)行了基準(zhǔn)測(cè)試。DeepInfra 每周處理近 5 萬(wàn)億個(gè) Token其中約 30% 由智能體系統(tǒng)驅(qū)動(dòng)。其云平臺(tái)專為高吞吐量的 AI 推理而打造?;鶞?zhǔn)測(cè)試表明在保持相同服務(wù)質(zhì)量的前提下Vera CPU 支持的并發(fā) AI 智能體數(shù)量比其他 CPU多出高達(dá) 1.6 倍編排速度快 2.2 倍同時(shí)還能提高基礎(chǔ)設(shè)施的利用率和成本效益。這些結(jié)果充分證明NVIDIA Vera CPU 能夠提供生產(chǎn)級(jí)智能體 AI 所需的成本效益、低延遲和高吞吐量。DeepInfra 的基準(zhǔn)測(cè)試充分凸顯了 NVIDIA Vera CPU 如何幫助云服務(wù)提供商提升基礎(chǔ)設(shè)施利用率、提高成本效益并在保持相同服務(wù)質(zhì)量的前提下支持更多并發(fā)的 AI 智能體。

相關(guān)新聞

[具身智能-718]:ROS2 元功能包(MetaPackage)完整解讀:元功能包 = 沒(méi)有源碼、沒(méi)有可執(zhí)行程序的「虛擬功能包」

[具身智能-718]:ROS2 元功能包(MetaPackage)完整解讀:元功能包 = 沒(méi)有源碼、沒(méi)有可執(zhí)行程序的「虛擬功能包」

📖 ROS2 元功能包(MetaPackage)完整解讀一、核心定義(對(duì)應(yīng)幻燈片內(nèi)容)元功能包 沒(méi)有源碼、沒(méi)有可執(zhí)行程序的「虛擬功能包」類比:一本書的目錄索引,自身沒(méi)有正文,只是匯總、引用其他…

2026/8/2 18:17:00 閱讀更多
AgentWorld:原生語(yǔ)言世界模型如何統(tǒng)一跨平臺(tái)人機(jī)交互自動(dòng)化

AgentWorld:原生語(yǔ)言世界模型如何統(tǒng)一跨平臺(tái)人機(jī)交互自動(dòng)化

1. 項(xiàng)目概述:一個(gè)模型,如何重塑人機(jī)交互的邊界? 最近,開(kāi)源社區(qū)又被阿里千問(wèn)團(tuán)隊(duì)投下了一顆“重磅炸彈”。他們開(kāi)源了一個(gè)名為 AgentWorld 的原生語(yǔ)言世界模型。這個(gè)項(xiàng)目的標(biāo)題信息量巨大:“一個(gè)模型打通終端、網(wǎng)頁(yè)與…

2026/8/2 18:07:00 閱讀更多
React Native 源碼分析(一)——啟動(dòng)流程

React Native 源碼分析(一)——啟動(dòng)流程

本系列文章,是分析Android 的 React Native 的源碼,主要包括以下文章,和以往的源碼系列一樣,分析主流程的代碼,不會(huì)細(xì)致到每一行(但相比上一篇的Gradle源碼分析,要細(xì)致很多),會(huì)涉及到j(luò)ava、C++、js等源碼。 前三篇RN版本是0.64.0,后面是0.72.0 1、React Native 源碼…

2026/8/2 19:07:02 閱讀更多
JMeter+InfluxDB壓測(cè)數(shù)據(jù)寫入瓶頸:配置優(yōu)化與全鏈路監(jiān)控實(shí)戰(zhàn)

JMeter+InfluxDB壓測(cè)數(shù)據(jù)寫入瓶頸:配置優(yōu)化與全鏈路監(jiān)控實(shí)戰(zhàn)

1. 壓測(cè)場(chǎng)景下的數(shù)據(jù)寫入:一個(gè)被忽視的性能瓶頸 最近在復(fù)盤一個(gè)線上壓測(cè)項(xiàng)目時(shí),又遇到了一個(gè)典型的“壓測(cè)后遺癥”——JMeter的測(cè)試結(jié)果數(shù)據(jù)無(wú)法正常寫入InfluxDB。這已經(jīng)不是第一次了,每次排查都發(fā)現(xiàn),問(wèn)題根源往往不是工具本身&a…

2026/8/2 19:07:02 閱讀更多
Unity2022安裝DOTween報(bào)錯(cuò)?四種可靠解決方案與深度排查指南

Unity2022安裝DOTween報(bào)錯(cuò)?四種可靠解決方案與深度排查指南

1. 項(xiàng)目概述:Unity2022與DOTween的“水土不服”如果你正在用Unity2022開(kāi)發(fā)游戲,尤其是想給UI或者角色動(dòng)作加點(diǎn)絲滑的動(dòng)畫效果,那么DOTween這個(gè)插件大概率是你的首選。它幾乎是Unity社區(qū)里做補(bǔ)間動(dòng)畫的“瑞士軍刀”,功能強(qiáng)大&#…

2026/8/2 19:07:02 閱讀更多
UE5 UserWidget藍(lán)圖開(kāi)發(fā):數(shù)據(jù)驅(qū)動(dòng)UI與雙向通信實(shí)戰(zhàn)指南

UE5 UserWidget藍(lán)圖開(kāi)發(fā):數(shù)據(jù)驅(qū)動(dòng)UI與雙向通信實(shí)戰(zhàn)指南

1. 項(xiàng)目概述:為什么UserWidget是UE5界面開(kāi)發(fā)的核心 在虛幻引擎5(UE5)的開(kāi)發(fā)中,無(wú)論是制作一個(gè)簡(jiǎn)單的HUD血條,還是構(gòu)建一個(gè)復(fù)雜的角色屬性面板、背包系統(tǒng),甚至是整個(gè)游戲的主菜單,你最終都繞不開(kāi)…

2026/8/2 18:57:01 閱讀更多
MoneyPrinterPlus實(shí)戰(zhàn)指南:AI視頻批量生成與自動(dòng)化發(fā)布完整解決方案

MoneyPrinterPlus實(shí)戰(zhàn)指南:AI視頻批量生成與自動(dòng)化發(fā)布完整解決方案

MoneyPrinterPlus實(shí)戰(zhàn)指南:AI視頻批量生成與自動(dòng)化發(fā)布完整解決方案 【免費(fèi)下載鏈接】MoneyPrinterPlus AI一鍵批量生成各類短視頻,自動(dòng)批量混剪短視頻,自動(dòng)把視頻發(fā)布到抖音,快手,小紅書,視頻號(hào)上,賺錢從來(lái)沒(méi)有這么容易過(guò)! 支持本地語(yǔ)音模型chatTTS,fasterwhisper,…

2026/8/2 0:04:00 閱讀更多
3分鐘搞定!QQ空間歷史說(shuō)說(shuō)完整備份終極指南

3分鐘搞定!QQ空間歷史說(shuō)說(shuō)完整備份終極指南

3分鐘搞定!QQ空間歷史說(shuō)說(shuō)完整備份終極指南 【免費(fèi)下載鏈接】GetQzonehistory 獲取QQ空間發(fā)布的歷史說(shuō)說(shuō) 項(xiàng)目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory 你是否曾想過(guò),那些年發(fā)過(guò)的QQ空間說(shuō)說(shuō),那些記錄青春的文字…

2026/8/2 0:04:01 閱讀更多
MoneyPrinterPlus實(shí)戰(zhàn)指南:AI視頻批量生成與自動(dòng)化發(fā)布完整解決方案

MoneyPrinterPlus實(shí)戰(zhàn)指南:AI視頻批量生成與自動(dòng)化發(fā)布完整解決方案

MoneyPrinterPlus實(shí)戰(zhàn)指南:AI視頻批量生成與自動(dòng)化發(fā)布完整解決方案 【免費(fèi)下載鏈接】MoneyPrinterPlus AI一鍵批量生成各類短視頻,自動(dòng)批量混剪短視頻,自動(dòng)把視頻發(fā)布到抖音,快手,小紅書,視頻號(hào)上,賺錢從來(lái)沒(méi)有這么容易過(guò)! 支持本地語(yǔ)音模型chatTTS,fasterwhisper,…

2026/8/2 0:04:00 閱讀更多
3分鐘搞定!QQ空間歷史說(shuō)說(shuō)完整備份終極指南

3分鐘搞定!QQ空間歷史說(shuō)說(shuō)完整備份終極指南

3分鐘搞定!QQ空間歷史說(shuō)說(shuō)完整備份終極指南 【免費(fèi)下載鏈接】GetQzonehistory 獲取QQ空間發(fā)布的歷史說(shuō)說(shuō) 項(xiàng)目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory 你是否曾想過(guò),那些年發(fā)過(guò)的QQ空間說(shuō)說(shuō),那些記錄青春的文字…

2026/8/2 0:04:01 閱讀更多
AMAT 0100-02186 I/O 分配 PCB

AMAT 0100-02186 I/O 分配 PCB

AMAT 0100-02186 I/O分配PCB板是應(yīng)用材料(Applied Materials)公司生產(chǎn)的一款用于半導(dǎo)體設(shè)備的I/O信號(hào)分配電路板。該型號(hào)(0100-02186)的核心特點(diǎn)如下:專用于Endura等半導(dǎo)體工藝腔室。集成信號(hào)路由與分配功能。連接控制…

2026/8/2 2:51:21 閱讀更多
Nissei Corp FFMN-32L-10-T0 40AX 三相異步電動(dòng)機(jī)

Nissei Corp FFMN-32L-10-T0 40AX 三相異步電動(dòng)機(jī)

Nissei Corp FFMN-32L-10-T0 40AX 三相異步電動(dòng)機(jī)是日本日清(Nissei)品牌的一款工業(yè)用三相異步電機(jī),適用于自動(dòng)化設(shè)備及通用機(jī)械驅(qū)動(dòng)。該型號(hào)(FFMN-32L-10-T0 40AX)的核心特點(diǎn)如下:三相交流異步電動(dòng)機(jī)。額定…

2026/8/2 2:52:49 閱讀更多