🌍較早收集於 59m

Google 每月支付 SpaceX 9.2 億美元以獲取 AI 運算資源

Google 每月支付 SpaceX 9.2 億美元以獲取 AI 運算資源
PostLinkedIn
🌍閱讀原文: The Next Web (TNW)

💡Google 每月 9.2 億美元的運算交易,揭示了現代 AI 所需的龐大基礎設施規模。

⚡ 30-Second TL;DR

有什麼變化

合約價值:從 2026 年 10 月至 2029 年 6 月,每月 9.2 億美元。

為什麼重要

此交易凸顯了高階 AI 運算資源的極度稀缺,以及科技巨頭為維持具競爭力的 AI 基礎設施所需投入的龐大資本支出。

下一步行動

評估您的基礎設施擴展策略,因為運算成本仍是大型 AI 部署的關鍵瓶頸。

誰應關注:Developers & AI Engineers

關鍵要點

  • 合約價值:從 2026 年 10 月至 2029 年 6 月,每月 9.2 億美元。
  • 硬體:使用約 110,000 個 Nvidia GPU、CPU 及記憶體。
  • 基礎設施:利用原本為 Grok 建造的資料中心。
  • Google 與 SpaceX 之間用於擴展 AI 運算能力的策略合作。

🧠 深度解析

Web-grounded analysis with 28 cited sources.

🔑 增強重點摘要

  • 這項協議被 Google 明確描述為一項「過渡性容量」安排,旨在滿足其 Gemini Enterprise 代理平台不斷增長的需求,該平台的需求已超出預期。
  • SpaceX 於 2026 年 2 月收購了 xAI,而這些資料中心(位於田納西州孟菲斯和密西西比州南黑文的 Colossus 1 和 Colossus 2)最初是為 xAI 的 Grok 模型所建。
  • SpaceX 正在積極將其 AI 基礎設施貨幣化,除了與 Google 的交易外,還與 Anthropic 簽署了一項類似的運算容量協議,每月費用為 12.5 億美元,直至 2029 年 5 月,同樣利用其 Colossus 1 設施。
  • 該合約包含終止條款,若 SpaceX 未能在 2026 年 9 月前交付承諾的 GPU 數量,Google 可終止協議;或自 2026 年 12 月 31 日起,任何一方均可提前 90 天通知終止。
  • Google 的母公司 Alphabet 最近透過創紀錄的股票發行籌集了 847.5 億美元股本,以擴展其 AI 基礎設施,這表明除了外部合作外,公司內部也進行了大量投資。
📊 競品分析▸ Show
特點/公司SpaceX (作為基礎設施供應商)AWS (NVIDIA 合作)Microsoft Azure (NVIDIA 合作)Anthropic (作為資源租用者)Google (內部基礎設施)
角色AI 運算基礎設施供應商雲端服務供應商,部署 NVIDIA AI 基礎設施雲端服務供應商,部署 NVIDIA AI 基礎設施AI 模型開發商,租用運算資源AI 模型開發商及雲端服務供應商,內部開發與外部租用並行
運算容量110,000 個 Nvidia GPU (提供給 Google);另有提供給 Anthropic 的容量超過 100 萬個 NVIDIA GPU數十萬個液冷 NVIDIA Grace Blackwell GPU租用 SpaceX Colossus 1 的全部運算容量;與 Google 和 Broadcom 簽訂數吉瓦 TPU 容量協議內部開發 TPU 8t/8i;A5X 裸機實例 (NVIDIA Vera Rubin NVL72)
主要客戶/用途Google Gemini Enterprise;Anthropic Claude各行各業的 AI 運算需求企業 AI 工作負載,代理式 AI 工廠訓練及運行其 Claude 模型支援 Gemini 模型、消費性 AI 服務、企業 AI 產品
GPU 架構Nvidia H100 (Colossus 最初配置);可能包含 H200NVIDIA Blackwell 和 Rubin GPU 架構NVIDIA Grace Blackwell, NVIDIA Vera Rubin NVL72AWS Trainium, Google TPUs, NVIDIA GPUsNVIDIA Vera Rubin NVL72 (A5X 實例)
合約價值/投資Google 合約每月 9.2 億美元 (總計約 300 億美元);Anthropic 合約每月 12.5 億美元部署超過 100 萬個 GPU部署數十萬個 GPU與 SpaceX 合約每月 12.5 億美元;與 Google/Broadcom 簽訂數吉瓦 TPU 容量協議Alphabet 計劃籌集 847.5 億美元股本擴展 AI 基礎設施;年度資本支出 1800-1900 億美元

🛠️ 技術深入

  • 運算硬體:該協議涉及約 110,000 個 Nvidia GPU,以及 CPU、記憶體及其他相關組件。
  • GPU 型號:SpaceX 的 Colossus 超級電腦最初配置了 100,000 個 NVIDIA H100 GPU,並計劃擴展至 200,000 個,其中可能包含更快的 H200 GPU。
  • 資料中心架構:Colossus 被譽為「世界上最強大的 AI 訓練系統」,並利用 NVIDIA 的 Hopper GPU 和 Spectrum-X Ethernet 進行高端網路和軟體解決方案。
  • xAI 訓練堆疊:採用基於 JAX 的建模和訓練層,提供可組合的並行原語,能很好地映射到大型 TPU/GPU 網格。
  • 控制平面:使用 Rust 編寫的控制平面,負責協調訓練作業、監控節點健康狀況並自動化故障恢復。
  • 底層平台:基於 Kubernetes 的底層平台,用於調度工作負載、處理容器化及抽象底層 GPU 集群。
  • 模型架構支援:基礎設施專為 Mixture-of-Experts (MoE) 模型設計,需要高頻寬互連(NVLink 級或 RDMA 結構)以在多個 GPU 之間同步激活和梯度。

🔮 前景展望AI analysis grounded in cited sources

SpaceX 將鞏固其作為主要 AI 基礎設施供應商的地位,超越其核心太空業務。
透過與 Google 和 Anthropic 的大規模協議,SpaceX 正將其在 AI 運算方面的巨大投資貨幣化,從而使其收入來源多樣化,並在 AI 運算市場中確立關鍵地位。
Google 將加速其代理式 AI 平台(特別是 Gemini Enterprise)的部署和擴展。
從 SpaceX 獲取「過渡性容量」直接解決了 Google 對 Gemini Enterprise 不斷增長的客戶需求,從而實現更快的市場滲透和服務擴展。
對大規模 AI 運算資源的競爭將加劇,推動進一步的整合和創新的基礎設施解決方案。
這項交易的巨大規模,以及 AWS、Microsoft 和 Anthropic 的類似投資,凸顯了對 GPU 和專業資料中心的極端需求,促使各公司探索多樣化的獲取和開發策略,包括潛在的軌道資料中心。

時間線

2023-03
Elon Musk 創立 xAI 公司
2024-07
xAI 位於田納西州孟菲斯的 Colossus 超級電腦投入運營,最初配備 100,000 個 Nvidia H100 GPU
2024-12
xAI 宣布計劃使用 100,000 個 Nvidia H100 GPU 擴展 Grok 3 訓練,並目標在 2025 年底前達到 100 萬個 GPU
2026-02
SpaceX 收購 xAI
2026-04
Anthropic 與 SpaceX 簽署協議,租用 SpaceX Colossus 1 資料中心的全部運算容量
2026-06
Google 與 SpaceX 簽署每月 9.2 億美元的協議,從 2026 年 10 月起使用 110,000 個 Nvidia GPU 及相關基礎設施
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: The Next Web (TNW)