🏕️极客公园•較早收集於 26m
平頭哥發布磐脈 920 AI 智能網卡

💡解決 AI 叢集網力瓶頸,400G 智能網卡提升效率 14%。
⚡ 30-Second TL;DR
有什麼變化
內置 PCIe Switch 實現 GPU/CPU 直接低延遲連接,路徑統一。
為什麼重要
磐脈 920 解決「網力」短缺,可能將萬卡叢集 GPU 使用率提升至 60% 以上。提升大規模 AI 訓練/推理的成本效率。強化阿里巴巴全棧 AI 基礎設施,涵蓋算力、存力和網力。
下一步行動
在阿里雲試用中基準測試磐脈 920,用於下一個 GPU 叢集部署。
誰應關注:Enterprise & Security Teams
關鍵要點
- •內置 PCIe Switch 實現 GPU/CPU 直接低延遲連接,路徑統一。
- •多路徑 RDMA 實現單 QP 400G 頻寬,交換機緩衝區降低 90%。
- •可程式化擁塞控制與細粒度感知,實現主動排程。
- •叢集測試中,大模型訓練/推理時間縮短 14%。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •磐脈 920 採用了平頭哥自研的玄鐵處理器核心,專門針對 AI 網路負載進行了指令集優化,以處理複雜的封包調度任務。
- •該網卡支援先進的虛擬化技術,能夠在雲端原生環境中實現硬體級的資源隔離,確保多租戶場景下 AI 訓練任務的網路頻寬穩定性。
- •透過與阿里雲自研的飛天作業系統深度整合,磐脈 920 實現了網路層與計算層的協同調度,進一步降低了大規模分散式運算中的同步延遲。
📊 競品分析▸ Show
| 特性 | 平頭哥 磐脈 920 | NVIDIA BlueField-3 | Intel IPU (Mount Evans) |
|---|---|---|---|
| 核心架構 | 自研玄鐵 RISC-V | ARM Neoverse | ARM Neoverse |
| 網路頻寬 | 400G | 400G | 200G/400G |
| PCIe Switch | 內置 | 需外部擴展 | 需外部擴展 |
| 主要優勢 | 針對阿里雲生態深度優化 | 生態系統成熟,軟體支援廣 | 雲端基礎設施標準化 |
🛠️ 技術深入
- 晶片架構:整合多個玄鐵 RISC-V 核心,負責處理網路協定堆疊與擁塞控制演算法。
- 介面規格:支援 PCIe Gen5 x16,提供高達 128GB/s 的雙向頻寬,滿足 GPU 與網卡間的直接通訊需求。
- RDMA 實作:支援 RoCE v2 協定,並透過硬體卸載引擎實現零拷貝(Zero-copy)傳輸。
- 擁塞控制:採用基於 AI 預測的動態頻寬分配演算法,能即時偵測網路熱點並自動調整流量路徑。
🔮 前景展望AI analysis grounded in cited sources
平頭哥將推動 RISC-V 架構在資料中心網路設備中的標準化。
磐脈 920 的成功量產證明了 RISC-V 在高性能網路處理領域具備與 ARM 架構競爭的實力。
阿里雲將逐步降低對第三方智能網卡供應商的依賴。
自研網卡的大規模部署能顯著降低硬體採購成本,並提升對雲端基礎設施底層架構的掌控力。
⏳ 時間線
2018-09
阿里巴巴成立平頭哥半導體有限公司,正式進軍晶片領域。
2021-10
平頭哥發布首款雲端 SoC 晶片「倚天 710」,為後續網路晶片研發奠定基礎。
2026-05
平頭哥正式發布磐脈 920 AI 智能網卡,並在阿里雲資料中心投入商用。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 极客公园 ↗


