🏕️較早收集於 26m

平頭哥發布磐脈 920 AI 智能網卡

平頭哥發布磐脈 920 AI 智能網卡
PostLinkedIn
🏕️閱讀原文: 极客公园

💡解決 AI 叢集網力瓶頸,400G 智能網卡提升效率 14%。

⚡ 30-Second TL;DR

有什麼變化

內置 PCIe Switch 實現 GPU/CPU 直接低延遲連接,路徑統一。

為什麼重要

磐脈 920 解決「網力」短缺,可能將萬卡叢集 GPU 使用率提升至 60% 以上。提升大規模 AI 訓練/推理的成本效率。強化阿里巴巴全棧 AI 基礎設施,涵蓋算力、存力和網力。

下一步行動

在阿里雲試用中基準測試磐脈 920,用於下一個 GPU 叢集部署。

誰應關注:Enterprise & Security Teams

關鍵要點

  • 內置 PCIe Switch 實現 GPU/CPU 直接低延遲連接,路徑統一。
  • 多路徑 RDMA 實現單 QP 400G 頻寬,交換機緩衝區降低 90%。
  • 可程式化擁塞控制與細粒度感知,實現主動排程。
  • 叢集測試中,大模型訓練/推理時間縮短 14%。

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • 磐脈 920 採用了平頭哥自研的玄鐵處理器核心,專門針對 AI 網路負載進行了指令集優化,以處理複雜的封包調度任務。
  • 該網卡支援先進的虛擬化技術,能夠在雲端原生環境中實現硬體級的資源隔離,確保多租戶場景下 AI 訓練任務的網路頻寬穩定性。
  • 透過與阿里雲自研的飛天作業系統深度整合,磐脈 920 實現了網路層與計算層的協同調度,進一步降低了大規模分散式運算中的同步延遲。
📊 競品分析▸ Show
特性平頭哥 磐脈 920NVIDIA BlueField-3Intel IPU (Mount Evans)
核心架構自研玄鐵 RISC-VARM NeoverseARM Neoverse
網路頻寬400G400G200G/400G
PCIe Switch內置需外部擴展需外部擴展
主要優勢針對阿里雲生態深度優化生態系統成熟,軟體支援廣雲端基礎設施標準化

🛠️ 技術深入

  • 晶片架構:整合多個玄鐵 RISC-V 核心,負責處理網路協定堆疊與擁塞控制演算法。
  • 介面規格:支援 PCIe Gen5 x16,提供高達 128GB/s 的雙向頻寬,滿足 GPU 與網卡間的直接通訊需求。
  • RDMA 實作:支援 RoCE v2 協定,並透過硬體卸載引擎實現零拷貝(Zero-copy)傳輸。
  • 擁塞控制:採用基於 AI 預測的動態頻寬分配演算法,能即時偵測網路熱點並自動調整流量路徑。

🔮 前景展望AI analysis grounded in cited sources

平頭哥將推動 RISC-V 架構在資料中心網路設備中的標準化。
磐脈 920 的成功量產證明了 RISC-V 在高性能網路處理領域具備與 ARM 架構競爭的實力。
阿里雲將逐步降低對第三方智能網卡供應商的依賴。
自研網卡的大規模部署能顯著降低硬體採購成本,並提升對雲端基礎設施底層架構的掌控力。

時間線

2018-09
阿里巴巴成立平頭哥半導體有限公司,正式進軍晶片領域。
2021-10
平頭哥發布首款雲端 SoC 晶片「倚天 710」,為後續網路晶片研發奠定基礎。
2026-05
平頭哥正式發布磐脈 920 AI 智能網卡,並在阿里雲資料中心投入商用。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 极客公园