焦點
NVIDIA Vera Rubin NVL72 首度亮相 MLPerf Inference v6.1,展現領先效能 採用 NVIDIA Vera Rubin NVL72 系統的首次預覽測試結果, 其輸送量最高達 NVIDIA GB300 NVL72 的 3.7 倍
文.圖/陳信榮 2026-09-17 14:55:39系統效能、高效的基礎設施擴展能力,以及持續的軟體最佳化,是決定人工智慧(AI)推論經濟效益的關鍵因素。更高的系統效能代表能夠生成更多詞元,從而帶來更高營收。高效的擴展能力代表隨著硬體增加,輸送量也能成比例成長,以更少資源大規模服務使用者。持續最佳化則代表能從基礎設施投資中創造更多價值。
這三者的基礎在於平台通用性。同一套基礎設施可執行任何模型與工作負載,從訓練到推論、從推薦到推理,以及從語言到影片處理,皆能維持高利用率。
NVIDIA 平台專為全面最佳化上述能力而打造,今日公布的 MLPerf Inference v6.1 結果便充分展現這點:
● NVIDIA Vera Rubin NVL72系統首度亮相即展現領先效能:在首次 MLPerf Inference 預覽測試結果中,NVIDIA Vera Rubin NVL72 的輸送量較 GB300 NVL72 提升高達 3.7 倍。
● NVIDIA GB300 NVL72展現領先的擴展效率:一項橫跨四座 GB300 NVL72 機架、共使用 288 顆GPU的測試配置,達成 99% 的擴展效率,其輸送量相較單一機架基準近乎呈現線性成長。
● 持續的軟體最佳化推動效能提升:NVIDIA 在 MLPerf Inference v6.1 提交結果中的軟體最佳化,相較於 v6.0 版本,效能最高提升 1.6 倍。v6.1 提交截止後,最佳化工作仍持續進行,進一步帶來效能提升。
對於正在評估 AI 基礎設施決策的組織而言,效能、擴展效率與軟體速度,都是決定長期推論經濟效益的重要考量因素。
Vera Rubin NVL72首度亮相 MLPerf Inference 即展現領先效能
NVIDIA 針對 MLPerf Inference v6.1 測試套件中,兩項最具挑戰性的基準測試 DeepSeek-R1 與 Qwen3-VL,提交 Vera Rubin NVL72 的預覽測試結果。在離線、伺服器及互動情境下,Vera Rubin NVL72 採用 vLLM 與 NVIDIA Dynamo 開源推論框架,在 Qwen3-VL 上的輸送量最高達 GB300 NVL72 的 3.7 倍。在 DeepSeek-R1 上,採用 NVIDIA TensorRT-LLM 函式庫的輸送量則最高達 GB300 NVL72 的 2.5 倍。這些初步成果展現 NVIDIA 加速創新的步伐,以及效能如何透過持續的軟體最佳化進一步提升。
MLPerf Inference v6.1 封閉組別。結果於 2026 年 9 月 16 日擷取自 www.mlcommons.org。NVIDIA 平台結果來自以下提交項目:6.1-0106 與6.1-0074。MLPerf 名稱與標誌為 MLCommons Association 在美國及其他國家的註冊與未註冊商標。保留所有權利。嚴禁未經授權使用。更多資訊請參閱 www.mlcommons.org。
這項效能代表每座 Vera Rubin NVL72 機架所產生的詞元數量、服務的使用者數量,以及創造的營收,均遠高於 GB300 NVL72 機架,同時還能降低每詞元成本。
這些成果反映硬體與軟體的全端協同設計。Vera Rubin 增強的 Tensor Core 與 Transformer Engine 可加速推論的預填充與解碼階段,而 NVFP4 精度則能降低模型權重、注意力與 KV 快取的記憶體占用量,在幾乎不犧牲輸出品質的情況下提高輸送量。
Vera Rubin 提交結果大量採用分離式服務,將預填充與解碼分開處理,並搭配大規模專家平行化,讓驅動 DeepSeek-R1 與 Qwen3-VL 等模型的混合專家層達到最高效率。
NVL72 垂直擴展網域採用第六代 NVIDIA NVLink 與 NVLink Switch,相較現成乙太網路可提供高達 10 倍的封包速率,並將延遲降低 3 倍,建立互連基礎,讓這些技術能在機架規模下有效運作。
這項協同設計更延伸至 NVIDIA 合作夥伴生態系。Nebius 同樣提交 Vera Rubin NVL72 預覽測試結果,並展現出卓越的效能。
能夠進行多步驟推理、規劃與行動的 AI 代理,正在重塑推論效能的衡量方式。在 SemiAnalysis AgentX 等旨在反映這項轉變的基準測試中,Vera Rubin NVL72 於預覽測試的效能達 GB300 NVL72 的 30 倍。此外,即將推出的 MLPerf Endpoints 基準測試將為代理型推論工作負載帶來標準化的衡量方式,涵蓋傳統輸送量基準測試未能反映的面向。
NVIDIA GB300 NVL72 展現領先的擴展效率
擴展效率是衡量新增 GPU 能如何有效轉化為輸送量成長的指標,也是評估 AI 基礎設施生產力的關鍵標準。NVIDIA 透過各機架內具備高頻寬與低延遲的垂直擴展互連、機架之間的高頻寬網路,以及跨節點的高效協調請求,實現這項能力。NVIDIA 的 DeepSeek-R1(DSR1)提交結果從單座 GB300 NVL72 機架的 72 顆 GPU,擴展至四座機架的 288 顆 GPU,並在離線情境中達到 99% 的擴展效率。輸送量幾乎與增加的硬體數量成比例成長。
MLPerf Inference v6.1 封閉組別。結果於 2026 年 9 月 16 日擷取自 www.mlcommons.org。NVIDIA 平台結果來自以下提交項目:6.1-0073 與 6.1-0074。MLPerf 名稱與標誌為 MLCommons Association 在美國及其他國家的註冊與未註冊商標。保留所有權利。嚴禁未經授權使用。更多資訊請參閱 www.mlcommons.org。
擴展效率至關重要,因為增加 GPU 並不會自動帶來成比例的輸送量成長。如果 GPU 數量增加近一倍,輸送量卻僅提升個位數百分比,基礎設施的成本將遠高於效能回報。架構、互連技術與軟體必須同步擴展。
GB300 NVL72 亦在 WAN 2.2 文字轉影片基準測試中展現機架規模效率,達到每秒生成 0.65 部 720p 影片,每部影片生成時間為 5.7 秒,輸送量達單一節點的 9 倍,延遲則降低 7.5 倍。
軟體最佳化持續推動效能提升
NVIDIA 平台持續進行軟體開發,不斷提升效能並增加新功能。
在 v6.1 中,GB300 NVL72 於 Qwen3-VL 的效能最高達 v6.0 結果的 1.6 倍。這些提升來自較低精度的 KV 快取、更多核心融合、效能更高的核心,以及採用 vLLM 與 NVIDIA Dynamo 的分離式服務。軟體最佳化工作在 v6.1 提交截止後仍持續進行。針對 GPT-OSS-120B 與 DLRMv3 的提交後測試結果尚未經 MLCommons 驗證,但已顯示進一步的效能提升。
各種規模的 AI 推論
除了 NVIDIA Grace Blackwell 與 Vera Rubin NVL72 平台的結果外,NVIDIA 亦在全新推出的 Edge-Agentic 基準測試中,提交 Jetson AGX Thor 採用 NVIDIA TensorRT Edge-LLM 執行 Qwen3.6-27B 的結果。NVIDIA 合作夥伴生態系廣泛參與此次測試,共有 19 家合作夥伴展現出色效能,其中 8 家更採用多節點 Blackwell NVL72 系統。參與夥伴包括華碩、Azure、思科、CoreWeave、Crusoe、戴爾科技集團、富士通、技鋼科技、慧與科技、英業達、Lambda、神雲科技、Nebius、Oracle Cloud Infrastructure、雲達科技、Red Hat、ScitiX、美超微與緯穎。
從精巧的邊緣裝置到規模最大的 AI 工廠,NVIDIA 持續透過每年推出平台架構更新、不斷改善的軟體,以及以及專為大規模部署而建構的生態系,在整個技術堆疊推進效能。
進一步瞭解NVIDIA Vera Rubin平台。
→更多的【PCDIY!業界新聞】: 請見
→更多的【PCDIY!賣場情報】: 請見
→更多的【PCDIY!科技情報】: 請見
→更多的【IT資訊新聞】: 請見
→更多的【ITMan!資訊經理人】: 請見
→更多的【PCDIY!八卦】: 請見
延伸閱讀
(01)光華商場的新危機,淘寶網帶來的跨境電商價格戰48顆壞25顆》威騰WD RE 3TB硬碟驚爆鬧機瘟,WD3000FYYZ死機地雷硬碟故障率高到嚇人!
(03)高雄建國電腦商圈爆倒店潮,引爆網友熱議!
(04)Seagate硬碟廣告:我也不想當死雞隊友啊,引爆玩家熱議!
(05)PTT寫手門事件:電蝦板主發表不自殺聲明,引爆網友熱議!
(06)記憶體插上16GB有多爽,引爆網友熱議!
(07)英特爾Intel 10GbE網路卡X540T2,淘寶網水貨價格殺很大!
(08)SSD爆發連環關門潮,憶正Memoright驚傳財務危機疑似倒閉!
(09)幫組電腦到自己貼錢的經驗,引爆網友熱議!
(10)教授認證防毒軟體「360安全衛士」,引爆網友熱議!
(11)DDR4記憶體金手指歪掉惹,引爆網友熱議!
(12)原價屋的商業模式,引爆網友熱議!
(13)Intel CPU神保固,舊換新大升級引爆網友狂推聯強貨!
(14)日本寬頻網路10G光纖上網,引爆網友熱議!
(15)Windows XP再戰十年,引爆網友熱議!
(16)光華商場的下一步,全世界都在看!
(17)東芝TOSHIBA Harrier MG03ACA300 3TB企業級硬碟,中國水貨價格殺很大!
(18)洋垃圾神器,Xeon E5-2670實測開箱大作戰!
(19)硬碟故障資料救援,等了一年八個月...
(20)新一代玩家聖物,6700元買16核心32執行緒Xeon E5-2675 v3處理器!
(21)淘寶網洋垃圾再顯神威,1999元買到8核心16執行緒Xeon E5-2670神器級處理器!
(22)洋垃圾戰神,5999元買14核心28執行緒Xeon E5-2683v3神器級處理器!
(23)硬碟用SSD有多爽,引爆網友熱議!
(24)磁碟陣列要選RAID 5還是RAID 6 引爆網友熱議!
(25)電腦CPU沒三萬沒法玩這遊戲,引爆網友熱議!
(26)為什麼有人要推AMD CPU菜單,引爆網友熱議!
(27)200TB資料怎麼儲存,引爆網友熱議!
(28)硬碟故障資料救援報價3萬8 引爆網友熱議!
(29)NVIDIA顯示卡的品牌怎麼挑選 引爆網友熱議!
(30)高科技竹筷,對付笨重顯示卡的神兵利器!
(31)電腦機殼價格破萬 引爆網友熱議!
(32)be quiet!電源供應器爆假貨,引爆了鍵盤大戰!
隨著香港電訊、日本So-net寬頻上網業者,陸續提供10G光纖上網,讓玩家與專業用戶享受高速上網的極速快感。反觀我們台灣,中華電信HiNet還在供裝光世代500M/250M與光世代1G/600M,可以說:「人家都上太空,我們還在殺豬公!!!」- 發表您的看法
請勿張貼任何涉及冒名、人身攻擊、情緒謾罵、或內容涉及非法的言論。
請勿張貼任何帶有商業或宣傳、廣告用途的垃圾內容及連結。
請勿侵犯個人隱私權,將他人資料公開張貼在留言版內。
請勿重複留言(包括跨版重複留言)或發表與各文章主題無關的文章。
請勿張貼涉及未經證實或明顯傷害個人名譽或企業形象聲譽的文章。
您在留言版發表的內容需自負言論之法律責任,所有言論不代表PCDIY!雜誌立場,違反上述規定之留言,PCDIY!雜誌有權逕行刪除您的留言。
最近新增
- NVIDIA Vera Rubin NVL72 首度亮相 MLPerf Inference v6.1,展現領先效能 採用 NVIDIA Vera Rubin NVL72 系統的首次預覽測試結果, 其輸送量最高達 NVIDIA GB300 NVL72 的 3.7 倍
- 每日使用比例翻兩倍!大社會調查揭民眾AI應用新趨勢 貼身外腦再升級!旅遊排行程最夯、投資理財攀新高
- 台灣農產品牌危機:每 2 則農產品廣告、1 則涉嫌詐騙 屏東、台南、南投拉緊報! 詐團砸錢投「對話型」廣告
- 《RAVEN2:渡鴉》開啟「滿月森林」活動 提供包含「傳說聖衣」在內的月光主題賽季獎勵
- 看不見的字元也能攻擊?揭密 ASCII Smuggling 攻擊手法
- LG深化「懂你的AI」智慧生活 串聯產品、服務與在地體驗 持續拓展科技的在地價值
- AORUS前進2026東京電玩展 打造沉浸式高階電競體驗
- 中秋烤肉「烤網三強」散場後變地板三害! Roborock 石頭科技全新蒸氣洗地機 F25 Steam 白蒸蒸 破解油脂、黏膩與滿地碎屑
- 兆勤科技 Nebula 迎來重大升級,助 MSP 與中小企業提升維運效率
- NVIDIA 擴展用於容錯量子運算的開源 CUDA-Q 平台
- 「TAMASHII EXHIBITION 2026 IN KAOHSIUNG」 9月19日至9月28日於高雄駁二藝術特區盛大登場
- Supermicro與台灣主管機關合作 防止伺服器技術遭非法轉移
最多人點閱
- GIGABYTE GeForce GTX 1070 Xtreme Gaming實測開箱,電競級顯示卡中的頂尖之作!
- Seagate IRONWOLF 10TB機械硬碟實測開箱,氦氣填充那嘶狼守護者NAS HDD
- 「浦科特 PLEXTOR S2C 512GB SSD」實測開箱,超值型固態硬碟中的優質好貨!
- 洋垃圾神器,Xeon E5-2670實測開箱大作戰!
- MSI CORE FROZR L CPU散熱器實測開箱,微星電競產品再添新兵
- MSI GeForce GTX 1060 GAMING X 6G實測開箱,玩家級電競顯示卡中的神兵利器!
- MSI GeForce GTX 1080 GAMING X 8G實測開箱,史上最強大Pascal自製顯示卡全面來襲!
- 淘寶網洋垃圾再顯神威,1999元買到8核心16執行緒Xeon E5-2670神器級處理器!
- MSI GeForce GTX 1050 Ti GAMING X 4G實測開箱,中階電競顯示卡中的玩家精品!
- 微星MSI Aegis X-026TW快打旋風V同梱版實測開箱,VR電競桌機的頂尖之作!
- 捉對廝殺:AMD Ryzen 2200G/2400G VS Intel Core i3-8100/i5-8400
- 「浦科特 PLEXTOR M8PeY 256GB、512GB、1TB」實測開箱,玩家級NVMe型PCIe 3.0 x4 SSD效能實測大作戰!