🐯虎嗅•較早收集於 11m
NVIDIA Vera Rubin 瞄準1兆美元AI市場

💡NVIDIA Rubin + Groq解鎖35倍推理提升,1兆美元AI晶片帝國藍圖。(26字)
⚡ 30-Second TL;DR
有什麼變化
Vera Rubin NVL72:72顆Rubin GPU + 36顆Vera CPU,比Blackwell推理效率提升10倍。
為什麼重要
NVIDIA從晶片擴至全AI生態,鎖定代理及機器人熱潮中基礎設施主導。1兆美元營收預測預示巨型資料中心建設。
下一步行動
基準測試Vera Rubin中Groq LPU整合,用於高吞吐LLM推理。
誰應關注:Enterprise & Security Teams
關鍵要點
- •Vera Rubin NVL72:72顆Rubin GPU + 36顆Vera CPU,比Blackwell推理效率提升10倍。
- •收購Groq 3 LPU,解碼階段每兆瓦推理吞吐量提升35倍。
- •NemoClaw優化OpenClaw安全代理;Nemotron聯盟訓練開源模型。
- •GR00T N2機器人模型,BYD、吉利、Uber車隊採用DRIVE Hyperion。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 6 個來源。
🔑 增強重點摘要
- •Vera Rubin NVL72機架整合130萬個組件,來自20國80多家供應商,實現3.6 exaflops NVFP4推理性能與260 TB/s內部頻寬,超過全球網際網路總容量。[1][2]
- •Rubin GPU採用TSMC 3nm N3P製程,具3360億電晶體、288 GB HBM4記憶體與22 TB/s頻寬,TDP約2300W需資料中心重大升級。[1]
- •Vera CPU內建88個自訂Olympus Armv9.2核心支援空間多執行緒達176執行緒,透過NVLink C2C提供1.8 TB/s相干頻寬與1.5 TB LPDDR5X記憶體。[2][3]
- •Vera Rubin引入第三代機密運算,首度實現機架級CPU、GPU與NVLink安全保護,適用於前沿AI模型訓練與推理。[2][4]
- •Supermicro與Dell等9家合作夥伴推出Vera Rubin SuperCluster與PowerEdge系統,支援液冷與高達400 petaflops AI性能。[5]
📊 競品分析▸ Show
| 規格 | NVIDIA Vera Rubin | NVIDIA Blackwell B200 | 改善倍數 |
|---|---|---|---|
| 推理 (NVFP4) | 50 PFLOPS | ~10 PFLOPS | 5x |
| 訓練 (NVFP4) | 35 PFLOPS | ~10 PFLOPS | 3.5x |
| 記憶體 | 288 GB HBM4 | 192 GB HBM3e | 1.5x |
| 記憶體頻寬 | 22 TB/s | 8 TB/s | 2.8x |
| 電晶體 | 3360億 | 2080億 | 1.6x |
| NVLink頻寬 | 3.6 TB/s/GPU | 1.8 TB/s/GPU | 2x |
| 製程 | TSMC 3nm (N3P) | TSMC 4nm | |
| TDP | ~2300W | 1200W |
🛠️ 技術深入
- •Rubin GPU搭載第三代Transformer Engine,支援NVFP4/NVFP8低精度格式,提供50 PFLOPS推理與35 PFLOPS訓練性能,具硬體加速自適應壓縮。[3][4]
- •NVLink 6提供每GPU 3.6 TB/s雙向頻寬,機架總260 TB/s,內建網路計算加速集體運算,提升MoE模型訓練效率達4倍GPU節省。[2][4]
- •Vera CPU為88核心Olympus Arm設計,空間多執行緒支援176執行緒,1.2 TB/s LPDDR5X頻寬,作為AI工廠記憶體與控制樞紐,形成HBM4與LPDDR5X統一記憶體池。[2][3]
- •NVL72機架總性能:3.6 exaFLOPS NVFP4推理、2.5 exaFLOPS訓練、54 TB LPDDR5X與20.7 TB HBM4提供1.6 PB/s頻寬。[2]
- •新增AI原生儲存平台支援KV快取分層,提升長上下文推理5倍tokens/秒、5倍TCO效能與5倍功率效率。[6]
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
2026-01
CES發布Vera Rubin NVL72超級電腦平台與NVLink 6
2026-03
GTC大會推出Rubin GPU、Vera CPU及Groq LPU整合系統
📎 來源 (6)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- letsdatascience.com — Nvidia Just Shipped the Most Powerful AI Chip Ever Made
- Tom's Hardware — Nvidia Launches Vera Rubin Nvl72 AI Supercomputer at Ces Promises Up to 5x Greater Inference Performance and 10x Lower Cost Per Token Than Blackwell Coming 2h 2026
- tspasemiconductor.substack.com — 2026 Nvidia 6 Chips for the Next
- nvidianews.nvidia.com — Rubin Platform AI Supercomputer
- crn.com — Nvidia Vera Rubin Nine Hardware Cloud Companies Build Out Ecosystem
- blogs.nvidia.com — 2026 Ces Special Presentation
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅 ↗
每週 AI 簡報
每週一封,可隨時退訂。


