🇨🇳cnBeta (Full RSS)•最新收集於 23m
Nvidia 的 Groq 機架今年進駐 Nebius

💡Groq 機架正式投產,為 Nvidia 平台堆疊新增推理基礎設施選項。
⚡ 30-Second TL;DR
有什麼變化
Groq 3 LPX 機架已進入全面投產階段。
為什麼重要
這項部署可能為 AI 雲端服務商提供另一種執行推理工作負載的基礎設施選項。Groq 機架與 Nvidia CPU、GPU 平台結合,也可能促成更具彈性的異質資料中心設計。
下一步行動
追蹤 Nebius 即將推出的 Groq 3 LPX 服務,並在規劃容量遷移前,將其推理吞吐量與目前的 GPU 服務架構進行基準測試。
誰應關注:Enterprise & Security Teams
關鍵要點
- •Groq 3 LPX 機架已進入全面投產階段。
- •Nvidia 以 200 億美元完成相關的 Groq 收購。
- •Nebius 將讓這些機架與 Vera CPU 和 Rubin GPU 協同部署。
- •商業上線預計在今年稍晚進行。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 9 個來源。
🔑 增強重點摘要
- •Groq 3 LPX 機架採用三星電子(Samsung Electronics)的晶圓代工製程,與採用台積電(TSMC)製程的 Vera CPU 及 Rubin GPU 形成異質架構互補。
- •該系統透過「Nebius Token Factory」服務進行部署,旨在專門優化 AI 推論過程中對延遲極度敏感的「解碼(decode)」階段。
- •每個 Groq 3 LPX 機架內建 256 個 LP30 加速器,每個晶片配置 500MB 的晶片內 SRAM,以徹底消除記憶體頻寬瓶頸。
- •在 Gemma 4 31B 模型(100,000 token 上下文)測試中,該系統創下每秒 3,400 個輸出 token 的效能紀錄,號稱比現有替代方案快四倍。
- •Nvidia 執行長黃仁勳預期 Groq 架構機架未來將佔據資料中心約 25% 的空間,作為 Vera Rubin 平台的效能延伸。
📊 競品分析▸ Show
| 特性 | Nvidia Groq 3 LPX | 傳統 GPU 推論叢集 | TPU (Google) |
|---|---|---|---|
| 核心優勢 | 專用解碼加速 (SRAM) | 通用運算彈性 | 高度整合架構 |
| 推論速度 | 3,400 tokens/s (Gemma 4 31B) | 較低 | 中等 |
| 記憶體架構 | 晶片內 SRAM (低延遲) | HBM (高頻寬) | HBM/SRAM 混合 |
🛠️ 技術深入
- 採用 LP30 加速器架構,單機架搭載 256 個單元。
- 透過 500MB 晶片內 SRAM 設計,解決傳統 GPU 推論時常見的記憶體頻寬瓶頸。
- 專為 AI 推論的解碼階段設計,非取代通用 GPU,而是與 Vera CPU 及 Rubin GPU 協同運作。
- 支援超長上下文(100,000 token)處理,並維持極高的輸出速率。
🔮 前景展望AI analysis grounded in cited sources
Groq 3 LPX 將成為 Nvidia 資料中心產品線的標準配置。
黃仁勳公開表示該架構預計將佔據資料中心 25% 的空間,顯示其將與 Vera Rubin 平台深度整合。
Nebius 將在 2026 年底前成為全球推論速度最快的雲端服務商之一。
作為首個部署 Groq 3 LPX 的供應商,其 Token Factory 服務效能已證實優於現有市場替代方案四倍。
⏳ 時間線
2025-12
Nvidia 完成以 200 億美元收購 Groq 資產及相關技術團隊。
2026-08
Nvidia 正式宣布 Groq 3 LPX 機架進入全面量產階段。
📎 來源 (9)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: cnBeta (Full RSS) ↗
每週 AI 簡報
每週一封,可隨時退訂。


