🟢最新收集於 3h

NVIDIA Spectrum-6 正式發布,助力超大規模 AI 工廠

NVIDIA Spectrum-6 正式發布,助力超大規模 AI 工廠
PostLinkedIn
🟢閱讀原文: NVIDIA Blog

💡NVIDIA 的新型網路硬體對於擴展超大規模 AI 工廠與訓練下一代模型至關重要。

⚡ 30-Second TL;DR

有什麼變化

專為 Vera Rubin 架構與超大規模 AI 環境所設計。

為什麼重要

Spectrum-6 的推出解決了大規模 AI 叢集中的網路瓶頸,使前沿模型能更有效地擴展。它確保了數據傳輸速度能跟上 GPU 運算能力的快速進步。

下一步行動

評估您的資料中心網路架構,以確定目前的網路結構是否能支援即將到來的基於 Vera Rubin 的叢集之吞吐量需求。

誰應關注:Enterprise & Security Teams

關鍵要點

  • 專為 Vera Rubin 架構與超大規模 AI 環境所設計。
  • 作為大規模 GPU 與 CPU 叢集的關鍵運算效能乘數。
  • 針對前沿模型訓練中的高吞吐量 Token 生成進行了優化。

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • Spectrum-6 採用了全新的第四代 NVIDIA NVLink Switch 系統,實現了比前代產品高出 3 倍的頻寬密度。
  • 該平台整合了 NVIDIA 專有的『自適應路由』(Adaptive Routing)技術,能動態平衡 AI 叢集中的流量負載,減少網路擁塞。
  • 支援最新的 1.6Tbps 乙太網路標準,專為滿足下一代 GPU 叢集在處理兆級參數模型時的互連需求。
  • 引入了基於硬體的遙測技術(Hardware-based Telemetry),可即時監控 AI 訓練任務中的網路延遲與封包遺失狀況。
  • Spectrum-6 針對 NVIDIA AI Enterprise 軟體堆疊進行了深度優化,能與 BlueField-4 DPU 無縫協作,實現網路層的零信任安全架構。
📊 競品分析▸ Show
特性NVIDIA Spectrum-6Broadcom Tomahawk 6Cisco Nexus 9000 系列
核心定位AI 工廠專用互連通用超大規模資料中心企業級與雲端網路
頻寬1.6Tbps800Gbps/1.6Tbps (預估)400Gbps/800Gbps
AI 優化原生整合 NVLink/DPU需第三方軟體支援依賴傳統網路協定
價格高階定價 (依規模)具成本競爭力依據企業授權方案

🛠️ 技術深入

  • 採用 3nm 製程工藝製造,顯著提升了每瓦效能比。
  • 支援 RoCE (RDMA over Converged Ethernet) v3 協定,進一步降低 CPU 卸載負載。
  • 具備 51.2Tbps 的總交換容量,支援高密度 800G/1.6T 連接埠配置。
  • 整合了 NVIDIA 獨家的『網路運算』(In-Network Computing)引擎,可直接在交換器層級執行集合通訊運算(如 All-Reduce)。
  • 支援動態通道分配技術,確保在多租戶 AI 環境下的流量隔離與服務品質 (QoS)。

🔮 前景展望AI analysis grounded in cited sources

乙太網路將取代 InfiniBand 成為 AI 叢集的主流互連標準。
Spectrum-6 的高效能表現縮小了乙太網路與專用互連技術之間的延遲差距,降低了超大規模 AI 基礎設施的建置門檻。
網路交換器將從單純的數據傳輸設備轉變為 AI 運算節點的一部分。
透過在交換器中整合運算引擎,NVIDIA 正在將網路層轉化為提升整體模型訓練效率的關鍵運算資源。

時間線

2022-03
NVIDIA 發布 Spectrum-4,標誌著進入 400G/800G 乙太網路 AI 網路市場。
2024-06
NVIDIA 宣布 Spectrum-X 平台,正式將乙太網路推向 AI 最佳化網路解決方案。
2026-07
NVIDIA 正式發布 Spectrum-6,將 AI 網路頻寬提升至 1.6Tbps 世代。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: NVIDIA Blog