🖥️較早收集於 56m

Nvidia DGX Rubin NVL8 採用 Intel Xeon 6

Nvidia DGX Rubin NVL8 採用 Intel Xeon 6
PostLinkedIn
🖥️閱讀原文: Computerworld
#coopetition#ai-servers#x86-compatibility#inferencenvidia-dgx-rubin-nvl8nvidiainteldgx-rubin-nvl8xeon-6rubin-gpu

💡Nvidia Rubin AI 超級叢集採用 Intel CPU 實現企業規模—對推論基礎設施至關重要。(48字)

⚡ 30-Second TL;DR

有什麼變化

DGX Rubin NVL8 搭配八個 Rubin GPU 與 Intel Xeon 6776P CPU

為什麼重要

此整合透過維持 x86 基礎設施相容性,加速企業 AI 採用並降低部署風險。它強調 CPU 在 GPU 饋入工作流程中日益重要的角色,可能影響混合式 AI 伺服器設計。

下一步行動

評估 Xeon 6 在您的 Nvidia GPU 叢集中對代理式 AI 推論擴展的相容性。

誰應關注:Enterprise & Security Teams

關鍵要點

  • DGX Rubin NVL8 搭配八個 Rubin GPU 與 Intel Xeon 6776P CPU
  • 透過 NVLink 互連設計用於高吞吐量推論與代理式 AI
  • Xeon 6 提供高記憶體頻寬 (MRDIMM) 及 x86 企業相容性
  • 反映 coopetition:Nvidia 用 Intel 作為主機 CPU 同時開發 Grace/Vera
  • 確保即時 AI 無資料瓶頸的可擴展性

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 5 個來源。

🔑 增強重點摘要

  • DGX Rubin NVL8 配備 2 個 Intel Xeon 6776P 處理器,而非單一 CPU,並具備 2.3 TB 總 GPU 記憶體與 160 TB/s HBM 頻寬。[1]
  • 系統支援 NVFP4 推論性能達 400 PFLOPS,以及 NVFP4 訓練 280 PFLOPS(密集規格),系統功耗約 24 kW。[1]
  • DGX Rubin NVL8 可擴展至 SuperPOD 配置,64 個 NVL8 節點提供 512 個 GPU,用於 x86 使用者的大規模部署。[2]

🛠️ 技術深入

  • GPU 配置:8x NVIDIA Rubin GPUs,每 GPU 具第三代 Transformer Engine,支持 NVFP4 計算達 50 petaflops 用於 AI 推論。[3]
  • NVLink:第六代 NVLink 提供每 GPU 3.6 TB/s 頻寬,總系統 NVLink 頻寬 28.8 TB/s,支援無縫 GPU 間通訊與模型並行。[1][3]
  • 網路:8x OSFP 端口配 8x NVIDIA ConnectX-9 VPI(最高 800 Gb/s InfiniBand/Ethernet),另有 2x 400G QSP112 NVIDIA BlueField-4 DPUs。[1]
  • 軟體:支援 NVIDIA DGX OS、Ubuntu、Red Hat Enterprise Linux、Rocky。[1]

🔮 前景展望AI analysis grounded in cited sources

NVIDIA Rubin 平台將於 2026 年下半年透過合作夥伴廣泛可用
NVIDIA 表示 Rubin 已進入生產階段,技術夥伴如 Supermicro 和 Dell 計劃於 2026 年下半年推出相關系統。[4]
DGX Rubin NVL8 將加速 x86 基礎的生成式 AI 與科學計算工作負載
HGX Rubin NVL8 平台專為 x86 伺服器設計,結合 8 個 Rubin GPU 透過 NVLink,提升訓練、推論與 HPC 性能。[3]

時間線

2026-01
NVIDIA 於 CES 2026 推出 Rubin AI 計算平台,包括 DGX Rubin NVL8
2026-03
公布 DGX Rubin NVL8 規格細節,確認採用 2x Intel Xeon 6776P CPU 與 8x Rubin GPU
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Computerworld

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。