🇨🇳TechNode•最新收集於 26m
Alibaba Cloud 開放 M890 AI 超級節點

#cloud-computing#mixture-of-experts#ai-inferencealibaba-cloud-lingjun-zhenwu-m890alibaba cloudm890ulanqab
💡Alibaba Cloud 現可在中國提供用於兆參數模型推論的 64 卡 AI 運算單元。
⚡ 30-Second TL;DR
有什麼變化
M890 雲端實例現已透過 Alibaba Cloud 在中國提供服務。
為什麼重要
這項服務讓中國企業無須承擔建置專用資料中心的資本與營運負擔,即可使用大規模 AI 推論基礎設施。此舉可能加速超大型混合專家模型的部署,並加劇中國雲端服務商之間的競爭。
下一步行動
向 Alibaba Cloud 索取 M890 的容量與基準測試報價,並在烏蘭察布區域測試混合專家模型推論工作負載,與現有叢集進行比較。
誰應關注:Enterprise & Security Teams
關鍵要點
- •M890 雲端實例現已透過 Alibaba Cloud 在中國提供服務。
- •烏蘭察布是首個部署地區。
- •客戶可配置具備高速互連的 64 張加速卡運算單元。
- •該系統針對參數規模最高達 10 兆的混合專家模型推論工作負載。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •M890 超級節點採用了阿里巴巴自研的『靈駿』智算叢集架構,專為解決超大規模模型訓練與推論中的通訊瓶頸而設計。
- •該系統整合了阿里雲最新的 RDMA(遠端直接記憶體存取)網路技術,實現了微秒級的節點間延遲,確保 64 張加速卡能發揮近乎線性的擴展效能。
- •烏蘭察布資料中心因其氣候優勢與綠色能源供應,被選為該高功耗超級節點的首發基地,以降低大規模 AI 運算的 PUE(能源使用效率)值。
- •M890 支援動態資源排程,允許企業根據推論任務的即時負載,彈性調整運算單元的配置,而非僅限於固定 64 卡模式。
- •該服務特別針對國產 AI 加速晶片進行了底層驅動優化,旨在提升在供應鏈受限環境下的算力自主可控能力。
📊 競品分析▸ Show
| 特性 | Alibaba Cloud M890 | AWS P5 Instances | Google Cloud A3 Mega |
|---|---|---|---|
| 核心架構 | 靈駿智算叢集 | NVIDIA H100/H200 | NVIDIA H100 |
| 互連技術 | 自研 RDMA 高速互連 | EFA (Elastic Fabric Adapter) | IPU (Infrastructure Processing Unit) |
| 針對模型 | 10 兆參數 MoE 推論 | 通用大規模訓練/推論 | 通用大規模訓練/推論 |
| 區域優勢 | 中國市場/合規性 | 全球部署/生態系 | 全球部署/TPU 整合 |
🛠️ 技術深入
- 運算單元架構:採用模組化設計,單一超級節點包含 64 張高效能加速卡,透過高速互連匯流排實現記憶體池化。
- 網路層:搭載阿里雲自研的 HPN 7.0(High-Performance Network)架構,支援超大規模叢集下的無阻塞通訊。
- 模型支援:原生支援混合專家模型(MoE)的稀疏運算優化,透過專用算子庫加速專家層(Expert Layer)的調度與存取。
- 散熱與供電:針對高密度運算需求,採用液冷技術與智慧電源管理系統,支援單機櫃高達 50kW 以上的功率密度。
🔮 前景展望AI analysis grounded in cited sources
阿里雲將在 2027 年前將 M890 節點擴展至海外資料中心。
隨著全球企業對超大規模模型推論需求增加,阿里雲需透過全球化部署來維持其在雲端 AI 基礎設施的競爭力。
M890 的推出將顯著降低中國企業部署 10 兆參數級模型的營運成本。
透過雲端共享基礎設施與高效能互連技術,企業無需自行建置昂貴的超級電腦即可獲得同等算力。
⏳ 時間線
2023-04
阿里雲正式發布『靈駿』智算叢集,確立大規模 AI 運算基礎設施戰略。
2024-09
阿里雲在烏蘭察布資料中心完成大規模智算叢集擴容,為 M890 部署奠定基礎。
2026-06
M890 超級節點架構完成內部壓力測試,驗證了對 10 兆參數模型的高效支援。
2026-08
Alibaba Cloud 正式對外開放 M890 超級節點雲端實例服務。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechNode ↗
