🟩NVIDIA Developer Blog•較早收集於 3m
NVIDIA Vera Rubin POD AI 超級電腦

#ai-supercomputer#rack-scale#token-generationvera-rubin-podnvidiavera-rubin-pod
💡NVIDIA 7 晶片 AI 超級電腦因應每年 10 千兆+ 權杖 – 基礎設施擴展必備。(48字)
⚡ 30-Second TL;DR
有什麼變化
Vera Rubin POD 整合七顆晶片至五個機架規模系統
為什麼重要
此推出可實現超大規模 AI 訓練與推論,針對權杖密集工作負載,並讓 NVIDIA 主導 AI 基礎設施成長。AI 從業者獲得前所未有規模的代理系統藍圖。
下一步行動
查看 NVIDIA Developer Blog 的 Vera Rubin POD 規格,以規劃機架規模 AI 叢集。
誰應關注:Enterprise & Security Teams
關鍵要點
- •Vera Rubin POD 整合七顆晶片至五個機架規模系統
- •AI 權杖使用量每年超過 10 千兆
- •未來大多數權杖來自 AI 對 AI 互動
- •設計為完整的 AI 超級電腦解決方案
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 10 個來源。
🔑 增強重點摘要
- •Vera Rubin NVL72 達成 260 TB/s 的 NVLink 頻寬,超過整個網際網路的總頻寬,並支援 3,600 PFLOPS 的 NVFP4 推理性能[1][6]
- •Vera CPU 採用 88 個自訂設計的 Olympus 核心,具有完整 Armv9.2 相容性,並透過第二代 NVLink-C2C 提供 1.8 TB/s 的一致性頻寬,實現 CPU 與 GPU 記憶體的統一位址空間[4][6]
- •DGX Vera Rubin NVL72 單一機架包含 72 個 Rubin GPU、36 個 Vera CPU 和 20.7 TB 的 GPU 記憶體,DGX SuperPOD 配置則達到 576 個 GPU、288 個 CPU 和約 600 TB 的總記憶體[1][3]
- •Vera Rubin 平台引入無纜設計的計算托盤,相比 Blackwell 系統可將組裝和維修時間減少高達 18 倍[5]
- •ConnectX-9 SuperNIC 在 Vera Rubin NVL72 架構中每個 Rubin GPU 提供 1.6 Tb/s 的網路頻寬,確保 GPU 在專家分派和集體操作中不會成為網路瓶頸[4]
🛠️ 技術深入
Vera Rubin NVL72 架構與規格
- GPU 配置:72 個 Rubin GPU,每個配備 8 個 HBM4 記憶體堆疊,容量 288 GB,記憶體頻寬 22 TB/s[8]
- CPU 配置:36 個 Vera CPU,每個具有 1.5 TB LPDDR5X 記憶體(透過 SOCAMM 模組與 Micron 聯合開發),記憶體頻寬 1.2 TB/s[1]
- 互連技術:第六代 NVLink 提供 3.6 TB/s GPU 對 GPU 頻寬;NVLink-C2C 第二代提供 1.8 TB/s CPU-GPU 一致性頻寬[4][6]
- 網路架構:144+ 個單埠 ConnectX-9 OSFP 連接埠(800 Gb/s InfiniBand 和乙太網);18 個雙埠 BlueField-4 DPU(400 Gb/s)[3]
- 計算性能:NVFP4 推理 3,600 PFLOPS;NVFP4 訓練 2,520 PFLOPS;FP8/FP6 訓練 1,260 PFLOPS;FP32 9,360 TFLOPS[2]
- 冷卻系統:完全液冷設計的計算托盤,Vera CPU 和 Rubin GPU 透過 NVLink-C2C 在單一電路板上連接[7]
- 機架規模系統:單一 DGX SuperPOD 包含 8 個 NVL72 機架,總計 28.8 EFLOPS 計算性能(NVFP4 精度),足夠的 NVLink 頻寬使模型分割在機架內不再必要[1]
- 安全性:支援機架規模的機密計算,整個機架可加密,Vera CPU 與 Blackwell GPU 的機密計算技術完全同步[1]
🔮 前景展望AI analysis grounded in cited sources
統一記憶體位址空間將重新定義 AI 工作負載架構
Vera-Rubin 的 NVLink-C2C 一致性頻寬使 LPDDR5X 和 HBM4 可視為單一記憶體池,啟用 KV 快取卸載和多模型執行等技術,改變傳統 CPU-GPU 資料移動的瓶頸。
無纜設計與自動化維護將降低大規模 AI 基礎設施的營運成本
組裝和維修時間減少 18 倍,加上升級的 RAS 引擎自動化故障容錯和即時健康檢查,可顯著降低超大規模 AI 資料中心的總體擁有成本。
機架規模機密計算將加速受規管產業的 AI 部署
完整的機架級加密能力使金融、醫療和政府部門能在保持資料隱私的同時部署大規模 AI 模型,打開先前受限的市場。
⏳ 時間線
2026-01
NVIDIA 在 CES 2026 推出 Rubin 平台,包含六顆新晶片和 Vera Rubin NVL72 機架規模系統
2026-03
Vera Rubin NVL72 和 DGX SuperPOD 參考架構進入市場,支援 AI 工廠大規模部署
📎 來源 (10)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- servethehome.com — Nvidia Launches Next Generation Rubin AI Compute Platform at Ces 2026
- NVIDIA — Vera Rubin Nvl72
- NVIDIA — Dgx Vera Rubin Nvl72
- developer.nvidia.com — Inside the Nvidia Rubin Platform Six New Chips One AI Supercomputer
- siliconangle.com — Nvidia Debuts Rubin Chip 336b Transistors 50 Petaflops AI Performance
- nvidianews.nvidia.com — Rubin Platform AI Supercomputer
- substack.com — P 183613522
- naddod.com — Nvidia Rubin Platform AI Supercomputer with Six New Chips
- NVIDIA — Rubin
- crn.com — Nvidia Vera Rubin Nine Hardware Cloud Companies Build Out Ecosystem
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: NVIDIA Developer Blog ↗
每週 AI 簡報
每週一封,可隨時退訂。