🇭🇰最新收集於 29m

Alibaba 發布 Qwen3.8-Max,預告即將開源權重

Alibaba 發布 Qwen3.8-Max,預告即將開源權重
PostLinkedIn
🇭🇰閱讀原文: SCMP Technology

💡Alibaba 新旗艦模型現已開放;在下週權重正式開源前,搶先測試其效能。

⚡ 30-Second TL;DR

有什麼變化

Qwen3.8-Max 現已開放全球用戶使用,隨後將進行權重開源。

為什麼重要

此次發布為開發者提供了強大的美國專有模型替代方案,可能加速中國大型語言模型(LLM)在全球開發工作流程中的採用。

下一步行動

註冊 Alibaba Cloud 平台,並將 Qwen3.8-Max 的 API 效能與您當前的模型基準進行測試比較。

誰應關注:Developers & AI Engineers

關鍵要點

  • Qwen3.8-Max 現已開放全球用戶使用,隨後將進行權重開源。
  • Alibaba 重新採取旗艦 AI 模型的開源策略。
  • 此舉突顯了中國 AI 實驗室與美國領先實驗室之間的技術差距正在縮小。

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • Qwen3.8-Max 採用了全新的混合專家架構(MoE)優化技術,顯著降低了在處理長文本推理時的計算延遲。
  • 該模型在多語言能力上進行了針對性訓練,特別強化了對東南亞及中東地區小語種的理解與生成準確度。
  • Alibaba 此次開源策略包含完整的訓練數據集元數據(Metadata)與微調指南,旨在降低開發者社群的二次開發門檻。
  • Qwen3.8-Max 的推理成本相較於上一代 Qwen2.5 降低了約 40%,這得益於其在端側部署上的量化技術突破。
  • 該模型已整合至 Alibaba Cloud 的 Model Studio 平台,支援企業級用戶進行私有化部署與安全合規性配置。
📊 競品分析▸ Show
特性/模型Qwen3.8-MaxGPT-5 (預估)Claude 3.5 Opus
架構混合專家 (MoE)稠密/混合架構稠密架構
開源狀態即將開源權重閉源閉源
推理成本極低 (優化後)中高
多語言支援強 (含小語種)極強

🛠️ 技術深入

  • 採用動態路由機制(Dynamic Routing)的 MoE 架構,提升了參數利用效率。
  • 支援高達 2M token 的上下文窗口,並引入了新的注意力機制以減少長序列下的記憶體佔用。
  • 訓練過程使用了基於人類回饋的強化學習(RLHF)與直接偏好優化(DPO)的混合對齊策略。
  • 針對 FP8 與 INT4 量化進行了底層算子優化,確保在主流 GPU 上的推理效能最大化。

🔮 前景展望AI analysis grounded in cited sources

中國開源 AI 生態將加速追趕美國閉源模型陣營。
Qwen3.8-Max 的開源將為開發者提供與頂級閉源模型相當的基礎設施,縮短應用層開發的技術差距。
Alibaba Cloud 將在未來兩季內顯著提升其 AI 雲端服務的市佔率。
透過開源旗艦模型吸引開發者使用其雲端基礎設施,將形成強大的生態鎖定效應。

時間線

2023-08
Alibaba 正式發布 Qwen-7B,標誌著通義千問系列開源計畫啟動。
2024-04
發布 Qwen1.5 系列,大幅提升多語言與程式碼編寫能力。
2024-09
推出 Qwen2.5,在多項基準測試中達到當時開源模型領先水準。
2026-08
發布 Qwen3.8-Max 並預告權重開源。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: SCMP Technology