🇨🇳較早收集於 18h

英偉達 Groq 整合晶片供 OpenAI 推理

英偉達 Groq 整合晶片供 OpenAI 推理
PostLinkedIn
🇨🇳閱讀原文: cnBeta (Full RSS)

💡英偉達 + Groq 自訂晶片加速 OpenAI 推理

⚡ 30-Second TL;DR

有什麼變化

專為 OpenAI 及客戶定制處理器

為什麼重要

英偉達生態結合 Groq 速度,提供高效推理,可能降低 AI 部署成本並挑戰硬體競爭對手。

下一步行動

立即報名英偉達 GTC,體驗全新推理平台

誰應關注:Developers & AI Engineers

關鍵要點

  • 專為 OpenAI 及客戶定制處理器
  • 整合 Groq 創新晶片設計
  • 針對 AI 模型回應的推理計算
  • 下月英偉達 GTC 開發者大會亮相

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 4 個來源。

🔑 增強重點摘要

  • 英偉達與 Groq 簽訂非獨家授權協議,取得 Groq 硬體與架構技術授權,並將 Groq CEO Jonathan Ross 及其核心團隊納入英偉達。[2]
  • Groq LPU 採用 144-way VLIW 設計,無外部 DDR 或 HBM 記憶體,僅使用 230 MB 板載 SRAM,適合單使用者高速度推理但需多機架運行大型模型如 Llama 70B。[2]
  • Groq 於 2016 年開創 LPU 技術,為首款專為推理設計的晶片,Jonathan Ross 來自 Google 原 TPU 團隊,第一代晶片於 2019 年發布,使用 Globalfoundries 製程。[2][3]

🛠️ 技術深入

  • Groq LPU 為大型 144-way VLIW 設計,與 Google TPU 的 8-way VLIW 陣列不同,使用 Globalfoundries 製程生產,成本低且易擴展。[2]
  • 無外部記憶體設計,僅 230 MB SRAM 容量,導致運行 Llama 70B 等模型需 10 個機架及超過 100 kW 功率,但提供市場上最快的單使用者 token 每秒速度。[2]
  • 第二代晶片計劃於 2025 年使用 Samsung Foundry 4nm (SF4X) 製程產生收入,2026 年擴大規模,但尚未見市場證據。[2]

🔮 前景展望AI analysis grounded in cited sources

英偉達將於 2026 年 4 月 GTC 大會推出整合 Groq 技術的新推理晶片
多個來源確認英偉達計劃在下月聖何塞 GTC 開發者大會公布此定制處理器。[1][2]
此協議將加速英偉達在 AI 推理市場的領導地位
透過授權 Groq 高效 LPU 架構及吸收其團隊,英偉達可提升推理速度與成本效益,針對 OpenAI 等客戶需求。[2]

時間線

2016-01
Groq 開創 LPU 技術,為首款專為 AI 推理設計的晶片
2019-01
Groq 第一代 LPU 晶片發布,使用 Globalfoundries 製程
2024-01
Groq CEO 在 Samsung Foundry 活動宣布第二代 4nm 晶片 2025 年產生收入
2025-02
Groq 獲沙烏地阿拉伯 15 億美元承諾,用於擴大 LPU 交付
2025-12
英偉達與 Groq 簽訂非獨家推理技術授權協議,Groq 核心團隊加入英偉達

📎 來源 (4)

Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.

  1. longbridge.com — 277271740
  2. morethanmoore.substack.com — Ho Ho Ho Groq Nvidia Is a Gift
  3. groq.com
  4. investor.nvidia.com — Default
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: cnBeta (Full RSS)

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。