🐯較早收集於 11m

NVIDIA Vera Rubin 瞄準1兆美元AI市場

NVIDIA Vera Rubin 瞄準1兆美元AI市場
PostLinkedIn
🐯閱讀原文: 虎嗅
#ai-chips#inference#agent#roboticsnvidia-vera-rubinnvidiavera-rubingroqnemoclawgr00t-n2

💡NVIDIA Rubin + Groq解鎖35倍推理提升,1兆美元AI晶片帝國藍圖。(26字)

⚡ 30-Second TL;DR

有什麼變化

Vera Rubin NVL72:72顆Rubin GPU + 36顆Vera CPU,比Blackwell推理效率提升10倍。

為什麼重要

NVIDIA從晶片擴至全AI生態,鎖定代理及機器人熱潮中基礎設施主導。1兆美元營收預測預示巨型資料中心建設。

下一步行動

基準測試Vera Rubin中Groq LPU整合,用於高吞吐LLM推理。

誰應關注:Enterprise & Security Teams

關鍵要點

  • Vera Rubin NVL72:72顆Rubin GPU + 36顆Vera CPU,比Blackwell推理效率提升10倍。
  • 收購Groq 3 LPU,解碼階段每兆瓦推理吞吐量提升35倍。
  • NemoClaw優化OpenClaw安全代理;Nemotron聯盟訓練開源模型。
  • GR00T N2機器人模型,BYD、吉利、Uber車隊採用DRIVE Hyperion。

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 6 個來源。

🔑 增強重點摘要

  • Vera Rubin NVL72機架整合130萬個組件,來自20國80多家供應商,實現3.6 exaflops NVFP4推理性能與260 TB/s內部頻寬,超過全球網際網路總容量。[1][2]
  • Rubin GPU採用TSMC 3nm N3P製程,具3360億電晶體、288 GB HBM4記憶體與22 TB/s頻寬,TDP約2300W需資料中心重大升級。[1]
  • Vera CPU內建88個自訂Olympus Armv9.2核心支援空間多執行緒達176執行緒,透過NVLink C2C提供1.8 TB/s相干頻寬與1.5 TB LPDDR5X記憶體。[2][3]
  • Vera Rubin引入第三代機密運算,首度實現機架級CPU、GPU與NVLink安全保護,適用於前沿AI模型訓練與推理。[2][4]
  • Supermicro與Dell等9家合作夥伴推出Vera Rubin SuperCluster與PowerEdge系統,支援液冷與高達400 petaflops AI性能。[5]
📊 競品分析▸ Show
規格NVIDIA Vera RubinNVIDIA Blackwell B200改善倍數
推理 (NVFP4)50 PFLOPS~10 PFLOPS5x
訓練 (NVFP4)35 PFLOPS~10 PFLOPS3.5x
記憶體288 GB HBM4192 GB HBM3e1.5x
記憶體頻寬22 TB/s8 TB/s2.8x
電晶體3360億2080億1.6x
NVLink頻寬3.6 TB/s/GPU1.8 TB/s/GPU2x
製程TSMC 3nm (N3P)TSMC 4nm
TDP~2300W1200W

🛠️ 技術深入

  • Rubin GPU搭載第三代Transformer Engine,支援NVFP4/NVFP8低精度格式,提供50 PFLOPS推理與35 PFLOPS訓練性能,具硬體加速自適應壓縮。[3][4]
  • NVLink 6提供每GPU 3.6 TB/s雙向頻寬,機架總260 TB/s,內建網路計算加速集體運算,提升MoE模型訓練效率達4倍GPU節省。[2][4]
  • Vera CPU為88核心Olympus Arm設計,空間多執行緒支援176執行緒,1.2 TB/s LPDDR5X頻寬,作為AI工廠記憶體與控制樞紐,形成HBM4與LPDDR5X統一記憶體池。[2][3]
  • NVL72機架總性能:3.6 exaFLOPS NVFP4推理、2.5 exaFLOPS訓練、54 TB LPDDR5X與20.7 TB HBM4提供1.6 PB/s頻寬。[2]
  • 新增AI原生儲存平台支援KV快取分層,提升長上下文推理5倍tokens/秒、5倍TCO效能與5倍功率效率。[6]

🔮 前景展望AI analysis grounded in cited sources

2026下半年Vera Rubin將需資料中心升級高功率基礎設施
單GPU TDP達2300W是Blackwell兩倍,儘管系統效率提升,但絕對功率需求將限制大規模部署。[1]
Rubin平台將加速MoE模型採用,訓練GPU需求減4倍
第五代創新包括NVLink 6與Transformer Engine,針對巨型MoE推理提供10倍低token成本。[4]
機密運算擴展至機架級將提升AI前沿實驗室模型安全
首度涵蓋CPU、GPU與NVLink領域,保護專有模型訓練與推理免受洩漏威脅。[2][4]

時間線

2026-01
CES發布Vera Rubin NVL72超級電腦平台與NVLink 6
2026-03
GTC大會推出Rubin GPU、Vera CPU及Groq LPU整合系統
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。