🔥較早收集於 6m

阿里巴巴發布旗艦模型 Qwen3.7-Max

阿里巴巴發布旗艦模型 Qwen3.7-Max
PostLinkedIn
🔥閱讀原文: 36氪

💡全新旗艦模型,推理速度提升 10 倍,並具備處理複雜編程任務的強大自主智能體能力。

⚡ 30-Second TL;DR

有什麼變化

在 Arena 全球大模型盲測總榜中位列國產模型第一。

為什麼重要

該模型處理超長程自主智能體任務的能力,預示著 AI 驅動的軟體工程與複雜工作流自動化將邁向更可靠的階段。

下一步行動

在您的下一個自主智能體項目中評估 Qwen3.7-Max,特別是針對其工具調用效率與目前的 GPT-4o 或 Claude 3.5 Sonnet 基準進行對比測試。

誰應關注:Developers & AI Engineers

關鍵要點

  • 在 Arena 全球大模型盲測總榜中位列國產模型第一。
  • 專為自主智能體工作流設計,具備超長程任務處理能力。
  • 推理速度較前代版本提升 10 倍。
  • 成功完成 35 小時的複雜自主任務,調用工具超過 1,000 次。

🧠 深度解析

Web-grounded analysis with 24 cited sources.

🔑 增強重點摘要

  • 阿里巴巴於2026年5月20日正式發布Qwen3.7-Max,該模型在Arena全球大模型盲測總榜中位列全球第13名,是全球前十五名中唯一的中國模型。
  • Qwen3.7-Max在編程智能體方面表現卓越,於SWE-Pro、SWE-Multilingual等評測中取得領先,並在GPQA Diamond等推理核心評測中超越了Claude-Opus4.6及所有國產模型。
  • 該模型在國產芯片平台上展現了強大的優化能力,透過自主編程和超過1,000次工具調用,成功將一個關鍵內核的Triton算子性能提升了10倍。
  • 阿里巴巴在大模型研發上採取「小步快跑」策略,在近三個月內穩定迭代並發布了Qwen3.5、3.6、3.7三個旗艦大模型版本。
  • Qwen3.7-Max將透過API服務在阿里云百煉平台提供,並且Qwen3.7系列還將推出Qwen3.7-Plus等多模態版本,實現從編程智能體到視覺智能體的全面覆蓋。
📊 競品分析▸ Show
特性/模型阿里巴巴 Qwen3.7-MaxOpenAI GPT-4/5 (預期)Anthropic Claude OpusGoogle Gemini (3.1 Pro/3 Flash)月之暗面 Kimi-K2.6DeepSeek-v4-pro智譜AI GLM-5.1
發布日期2026年5月20日GPT-4已發布,GPT-5預期中已發布已發布已發布已發布已發布
主要優勢專為自主智能體優化,編程與推理能力強,長程任務處理,國產芯片優化通用能力強,編程能力優異,廣泛應用生態長上下文處理,編程能力優異多模態能力,與Google生態整合長上下文,中文能力強創新技術,開源模型表現突出中文能力,企業級應用
Arena全球盲測總榜國產模型第一,全球第13位 (接近GPT, Claude, Gemini最強模型)領先地位 (GPT-5.4/5.4-High排名靠前)領先地位 (Claude Opus 4.6/4.7排名靠前)領先地位 (Gemini-3.1/3 Pro排名靠前)被Qwen3.7-Max超越被Qwen3.7-Max超越被Qwen3.7-Max超越
編程智能體評測SWE-Pro、SWE-Multilingual等領先,Terminal Bench 2.0得分69.7,超越DeepSeek-v4-pro-Max、Claude-Opus4.6優秀表現優秀表現優秀表現被Qwen3.7-Max超越被Qwen3.7-Max超越-
推理能力評測GPQA Diamond等超越Claude-Opus4.6及所有國產模型優秀表現優秀表現優秀表現被Qwen3.7-Max超越--
算子優化實測10.0x幾何平均加速比---5.0x幾何平均加速比3.3x幾何平均加速比7.3x幾何平均加速比
開源策略部分模型開源 (Apache 2.0)專有模型,部分API提供專有模型專有模型專有模型部分模型開源部分模型開源
定價API服務 (阿里云百煉)API服務 (按使用量計費)API服務 (按使用量計費)API服務 (按使用量計費)API服務 (按使用量計費)API服務 (按使用量計費)API服務 (按使用量計費)

🛠️ 技術深入

  • Qwen3.7-Max是專為自主智能體(Agent)工作流全新設計的旗艦模型。
  • 該模型延續了Qwen3.6的萬億參數稀疏混合專家(MoE)架構,總參數量超過1萬億,預訓練數據量達36萬億tokens。
  • 稀疏激活機制有助於在保證強大性能的同時,有效控制推理成本。
  • Qwen3系列引入了「混合推理」機制,整合「快思考」(非推理模式)與「慢思考」(深度推理模式),使用者可根據任務難度靈活切換,以兼顧算力消耗與回答品質。
  • 模型在訓練中將任務、運行框架與驗證器進行解耦,並透過跨框架強化學習訓練,避免了針對特定基準的捷徑過擬合,以掌握通用的解題策略。
  • 在國產芯片平台上,Qwen3.7-Max透過自主編程和超過1,000次工具調用,實現了關鍵內核的自我進化,將Triton算子性能提升10倍。其優化過程包括Split-K分區、替換cudaMalloc為預分配的PyTorch變量、抹去查詢前綴長度時的同步cudaMemcpy動作,以及重構算子以在單個線程塊中同時處理全部4個query token。
  • 預計支援256K-1M tokens的超長上下文處理能力。
  • Qwen3.7系列將推出Qwen3.7-Plus等多模態版本,具備極強的多模態推理和視覺理解能力。

🔮 前景展望AI analysis grounded in cited sources

阿里巴巴將進一步鞏固其在自主智能體領域的領先地位。
Qwen3.7-Max專為自主智能體工作流設計,並在實際複雜任務中展現出卓越的長程任務處理和工具調用能力,預示其將成為智能體應用的核心基礎。
中國國產AI大模型在國際競爭中的地位將持續提升。
Qwen3.7-Max在多項國際基準測試中超越了部分國際頂尖模型,並在國產芯片上實現了顯著的性能優化,表明中國在AI基礎模型研發上的實力不斷增強。
AI模型與硬件優化的深度融合將成為行業新趨勢。
Qwen3.7-Max在國產芯片上實現了10倍的算子性能提升,這表明模型層面的優化正與底層硬件緊密結合,以實現更高效的AI部署和運行。

時間線

2023-04
阿里巴巴阿里云正式宣布通義千問對受邀企業用戶開啟內測,標誌著阿里巴巴正式踏入大語言模型領域。
2023-08
阿里云開源70億參數的Qwen-7B模型,成為中國IT巨頭首次開源大模型。
2023-09
阿里云宣布通義千問正式向社會公眾開放。
2025-04
新一代模型Qwen3正式開源,發布涵蓋0.6B至235B參數的8款模型,包括MoE和Dense模型,並引入「思考模式」與「非思考模式」。
2026-04
阿里巴巴發布Qwen3.6-Plus,在Code Arena編程榜單上排名全球第二,超越OpenAI、Google等國際巨頭。
2026-05
阿里巴巴發布全新一代千問旗艦模型Qwen3.7-Max,專為自主智能體任務優化,並在Arena全球大模型盲測總榜中位列國產模型第一。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 36氪