焦點

NVIDIA Vera Rubin NVL72 首度亮相 MLPerf Inference v6.1,展現領先效能 採用 NVIDIA Vera Rubin NVL72 系統的首次預覽測試結果, 其輸送量最高達 NVIDIA GB300 NVL72 的 3.7 倍

文.圖/陳信榮 2026-09-17 14:55:39

系統效能、高效的基礎設施擴展能力,以及持續的軟體最佳化,是決定人工智慧(AI)推論經濟效益的關鍵因素。更高的系統效能代表能夠生成更多詞元,從而帶來更高營收。高效的擴展能力代表隨著硬體增加,輸送量也能成比例成長,以更少資源大規模服務使用者。持續最佳化則代表能從基礎設施投資中創造更多價值。

這三者的基礎在於平台通用性。同一套基礎設施可執行任何模型與工作負載,從訓練到推論、從推薦到推理,以及從語言到影片處理,皆能維持高利用率。

NVIDIA 平台專為全面最佳化上述能力而打造,今日公布的 MLPerf Inference v6.1 結果便充分展現這點:

● NVIDIA Vera Rubin NVL72系統首度亮相即展現領先效能:在首次 MLPerf Inference 預覽測試結果中,NVIDIA Vera Rubin NVL72 的輸送量較 GB300 NVL72 提升高達 3.7 倍。
● NVIDIA GB300 NVL72展現領先的擴展效率:一項橫跨四座 GB300 NVL72 機架、共使用 288 顆GPU的測試配置,達成 99% 的擴展效率,其輸送量相較單一機架基準近乎呈現線性成長。
● 持續的軟體最佳化推動效能提升:NVIDIA 在 MLPerf Inference v6.1 提交結果中的軟體最佳化,相較於 v6.0 版本,效能最高提升 1.6 倍。v6.1 提交截止後,最佳化工作仍持續進行,進一步帶來效能提升。

對於正在評估 AI 基礎設施決策的組織而言,效能、擴展效率與軟體速度,都是決定長期推論經濟效益的重要考量因素。

Vera Rubin NVL72首度亮相 MLPerf Inference 即展現領先效能

NVIDIA 針對 MLPerf Inference v6.1 測試套件中,兩項最具挑戰性的基準測試 DeepSeek-R1 與 Qwen3-VL,提交 Vera Rubin NVL72 的預覽測試結果。

在離線、伺服器及互動情境下,Vera Rubin NVL72 採用 vLLM 與 NVIDIA Dynamo 開源推論框架,在 Qwen3-VL 上的輸送量最高達 GB300 NVL72 的 3.7 倍。在 DeepSeek-R1 上,採用 NVIDIA TensorRT-LLM 函式庫的輸送量則最高達 GB300 NVL72 的 2.5 倍。這些初步成果展現 NVIDIA 加速創新的步伐,以及效能如何透過持續的軟體最佳化進一步提升。

MLPerf Inference v6.1 封閉組別。結果於 2026 年 9 月 16 日擷取自 www.mlcommons.org。NVIDIA 平台結果來自以下提交項目:6.1-0106 與6.1-0074。MLPerf 名稱與標誌為 MLCommons Association 在美國及其他國家的註冊與未註冊商標。保留所有權利。嚴禁未經授權使用。更多資訊請參閱 www.mlcommons.org。

這項效能代表每座 Vera Rubin NVL72 機架所產生的詞元數量、服務的使用者數量,以及創造的營收,均遠高於 GB300 NVL72 機架,同時還能降低每詞元成本。

這些成果反映硬體與軟體的全端協同設計。Vera Rubin 增強的 Tensor Core 與 Transformer Engine 可加速推論的預填充與解碼階段,而 NVFP4 精度則能降低模型權重、注意力與 KV 快取的記憶體占用量,在幾乎不犧牲輸出品質的情況下提高輸送量。

Vera Rubin 提交結果大量採用分離式服務,將預填充與解碼分開處理,並搭配大規模專家平行化,讓驅動 DeepSeek-R1 與 Qwen3-VL 等模型的混合專家層達到最高效率。

NVL72 垂直擴展網域採用第六代 NVIDIA NVLink 與 NVLink Switch,相較現成乙太網路可提供高達 10 倍的封包速率,並將延遲降低 3 倍,建立互連基礎,讓這些技術能在機架規模下有效運作。

這項協同設計更延伸至 NVIDIA 合作夥伴生態系。Nebius 同樣提交 Vera Rubin NVL72 預覽測試結果,並展現出卓越的效能。

能夠進行多步驟推理、規劃與行動的 AI 代理,正在重塑推論效能的衡量方式。在 SemiAnalysis AgentX 等旨在反映這項轉變的基準測試中,Vera Rubin NVL72 於預覽測試的效能達 GB300 NVL72 的 30 倍。此外,即將推出的 MLPerf Endpoints 基準測試將為代理型推論工作負載帶來標準化的衡量方式,涵蓋傳統輸送量基準測試未能反映的面向。

NVIDIA GB300 NVL72 展現領先的擴展效率

擴展效率是衡量新增 GPU 能如何有效轉化為輸送量成長的指標,也是評估 AI 基礎設施生產力的關鍵標準。NVIDIA 透過各機架內具備高頻寬與低延遲的垂直擴展互連、機架之間的高頻寬網路,以及跨節點的高效協調請求,實現這項能力。

NVIDIA 的 DeepSeek-R1(DSR1)提交結果從單座 GB300 NVL72 機架的 72 顆 GPU,擴展至四座機架的 288 顆 GPU,並在離線情境中達到 99% 的擴展效率。輸送量幾乎與增加的硬體數量成比例成長。

MLPerf Inference v6.1 封閉組別。結果於 2026 年 9 月 16 日擷取自 www.mlcommons.org。NVIDIA 平台結果來自以下提交項目:6.1-0073 與 6.1-0074。MLPerf 名稱與標誌為 MLCommons Association 在美國及其他國家的註冊與未註冊商標。保留所有權利。嚴禁未經授權使用。更多資訊請參閱 www.mlcommons.org。

擴展效率至關重要,因為增加 GPU 並不會自動帶來成比例的輸送量成長。如果 GPU 數量增加近一倍,輸送量卻僅提升個位數百分比,基礎設施的成本將遠高於效能回報。架構、互連技術與軟體必須同步擴展。

GB300 NVL72 亦在 WAN 2.2 文字轉影片基準測試中展現機架規模效率,達到每秒生成 0.65 部 720p 影片,每部影片生成時間為 5.7 秒,輸送量達單一節點的 9 倍,延遲則降低 7.5 倍。

軟體最佳化持續推動效能提升

NVIDIA 平台持續進行軟體開發,不斷提升效能並增加新功能。

在 v6.1 中,GB300 NVL72 於 Qwen3-VL 的效能最高達 v6.0 結果的 1.6 倍。這些提升來自較低精度的 KV 快取、更多核心融合、效能更高的核心,以及採用 vLLM 與 NVIDIA Dynamo 的分離式服務。

軟體最佳化工作在 v6.1 提交截止後仍持續進行。針對 GPT-OSS-120B 與 DLRMv3 的提交後測試結果尚未經 MLCommons 驗證,但已顯示進一步的效能提升。

各種規模的 AI 推論

除了 NVIDIA Grace Blackwell 與 Vera Rubin NVL72 平台的結果外,NVIDIA 亦在全新推出的 Edge-Agentic 基準測試中,提交 Jetson AGX Thor 採用 NVIDIA TensorRT Edge-LLM 執行 Qwen3.6-27B 的結果。

NVIDIA 合作夥伴生態系廣泛參與此次測試,共有 19 家合作夥伴展現出色效能,其中 8 家更採用多節點 Blackwell NVL72 系統。參與夥伴包括華碩、Azure、思科、CoreWeave、Crusoe、戴爾科技集團、富士通、技鋼科技、慧與科技、英業達、Lambda、神雲科技、Nebius、Oracle Cloud Infrastructure、雲達科技、Red Hat、ScitiX、美超微與緯穎。

從精巧的邊緣裝置到規模最大的 AI 工廠,NVIDIA 持續透過每年推出平台架構更新、不斷改善的軟體,以及以及專為大規模部署而建構的生態系,在整個技術堆疊推進效能。

進一步瞭解NVIDIA Vera Rubin平台。

→更多的【PCDIY!業界新聞】: 請見

→更多的【PCDIY!賣場情報】: 請見

→更多的【PCDIY!科技情報】: 請見

→更多的【IT資訊新聞】: 請見

→更多的【ITMan!資訊經理人】: 請見

→更多的【PCDIY!八卦】: 請見

延伸閱讀

(01)光華商場的新危機,淘寶網帶來的跨境電商價格戰![http://www.pcdiy.com.tw/detail/5232]
(02)48顆壞25顆》威騰WD RE 3TB硬碟驚爆鬧機瘟,WD3000FYYZ死機地雷硬碟故障率高到嚇人!
(03)高雄建國電腦商圈爆倒店潮,引爆網友熱議!
(04)Seagate硬碟廣告:我也不想當死雞隊友啊,引爆玩家熱議!
(05)PTT寫手門事件:電蝦板主發表不自殺聲明,引爆網友熱議!
(06)記憶體插上16GB有多爽,引爆網友熱議!
(07)英特爾Intel 10GbE網路卡X540T2,淘寶網水貨價格殺很大!
(08)SSD爆發連環關門潮,憶正Memoright驚傳財務危機疑似倒閉!
(09)幫組電腦到自己貼錢的經驗,引爆網友熱議!
(10)教授認證防毒軟體「360安全衛士」,引爆網友熱議!
(11)DDR4記憶體金手指歪掉惹,引爆網友熱議!
(12)原價屋的商業模式,引爆網友熱議!
(13)Intel CPU神保固,舊換新大升級引爆網友狂推聯強貨!
(14)日本寬頻網路10G光纖上網,引爆網友熱議!
(15)Windows XP再戰十年,引爆網友熱議!
(16)光華商場的下一步,全世界都在看!
(17)東芝TOSHIBA Harrier MG03ACA300 3TB企業級硬碟,中國水貨價格殺很大!
(18)洋垃圾神器,Xeon E5-2670實測開箱大作戰!
(19)硬碟故障資料救援,等了一年八個月...
(20)新一代玩家聖物,6700元買16核心32執行緒Xeon E5-2675 v3處理器!
(21)淘寶網洋垃圾再顯神威,1999元買到8核心16執行緒Xeon E5-2670神器級處理器!
(22)洋垃圾戰神,5999元買14核心28執行緒Xeon E5-2683v3神器級處理器!
(23)硬碟用SSD有多爽,引爆網友熱議!
(24)磁碟陣列要選RAID 5還是RAID 6 引爆網友熱議!
(25)電腦CPU沒三萬沒法玩這遊戲,引爆網友熱議!
(26)為什麼有人要推AMD CPU菜單,引爆網友熱議!
(27)200TB資料怎麼儲存,引爆網友熱議!
(28)硬碟故障資料救援報價3萬8 引爆網友熱議!
(29)NVIDIA顯示卡的品牌怎麼挑選 引爆網友熱議!
(30)高科技竹筷,對付笨重顯示卡的神兵利器!
(31)電腦機殼價格破萬 引爆網友熱議!
(32)be quiet!電源供應器爆假貨,引爆了鍵盤大戰!












































發表您的看法

請勿張貼任何涉及冒名、人身攻擊、情緒謾罵、或內容涉及非法的言論。

請勿張貼任何帶有商業或宣傳、廣告用途的垃圾內容及連結。

請勿侵犯個人隱私權,將他人資料公開張貼在留言版內。

請勿重複留言(包括跨版重複留言)或發表與各文章主題無關的文章。

請勿張貼涉及未經證實或明顯傷害個人名譽或企業形象聲譽的文章。

您在留言版發表的內容需自負言論之法律責任,所有言論不代表PCDIY!雜誌立場,違反上述規定之留言,PCDIY!雜誌有權逕行刪除您的留言。