🦙較早收集於 4h

小型 Qwen3.5 模型已停產

小型 Qwen3.5 模型已停產
PostLinkedIn
🦙閱讀原文: Reddit r/LocalLLaMA
#model-drop#discontinuationqwen3.5qwen3.5

💡小型模型被砍—趕緊調整本地 LLM 設定以防出問題。(38字元)

⚡ 30-Second TL;DR

有什麼變化

小型 Qwen3.5 模型正式停產

為什麼重要

將焦點轉移至較大型 Qwen3.5 變體,用於本地部署,可能增加依賴小型模型使用者的硬體需求。

下一步行動

驗證官方 Alibaba 儲存庫中可用的 Qwen3.5 大小,並遷移管線。

誰應關注:Developers & AI Engineers

關鍵要點

  • 小型 Qwen3.5 模型正式停產
  • 由 /u/Illustrious-Swim9663 在 r/LocalLLaMA 發布
  • 標記為「即時」新聞並附連結與評論

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 6 個來源。

🔑 增強重點摘要

  • Qwen3.5於2026年2月16日發布,為代理式AI時代設計,具備視覺代理功能,能自主操作螢幕、開啟應用程式並自動化任務。[1]
  • Qwen3.5中型模型系列於2026年2月24日發布,包括Qwen3.5-35B-A3B等四款模型,位於旗艦397B-A17B與小型蒸餾模型之間,針對生產環境優化。[2]
  • Qwen3.5採用混合架構:Gated Delta Networks結合稀疏MoE,397B總參數僅激活17B,提升記憶體使用減50%、解碼速度增19倍,並支援多模態輸入。[1][3]
📊 競品分析▸ Show
模型架構活躍參數MMLU-Pro 分數視覺基準
Qwen3.5-397B-A17BMoE + Gated DeltaNet17B87.8MathVision 88.6, OCRBench 93.1
GPT-5.2未詳未詳87.4低於Qwen3.5
Claude 4.5 Opus未詳未詳89.5低於Qwen3.5

🛠️ 技術深入

  • 總參數397B,活躍參數17B,激活率約4.3%,每token路由至少數專家。
  • 架構:稀疏Mixture-of-Experts (MoE) 結合Gated Delta Networks,提供線性注意力,支援長上下文記憶並降低記憶體需求。
  • 多模態支援:從訓練初始融合文字、圖像、影片,具1M上下文視窗,支援201種語言。
  • 基準表現:代理基準如BFCL-V4 (72.2)、BrowseComp (63.8),中型模型Qwen3.5-35B-A3B僅3B活躍參數即超越前代235B模型。[1][2][3]

🔮 前景展望AI analysis grounded in cited sources

小型Qwen3.5停產將加速用戶轉向中型及旗艦模型
中型系列如35B-A3B已證明高效能且適合生產部署,取代小型模型需求。[2]
Qwen3.5混合架構將成為開源代理模型標準
其MoE與線性注意力降低成本並提升速度,基準超越競爭對手,利於全球部署。[1][3]
阿里巴巴將強化雲端託管Qwen3.5-Plus
停產小型模型後,重點推Alibaba Cloud Model Studio的1M上下文版本以維持市場份額。[5]

時間線

2025-09
發布Qwen3-Next-80B-A3B,引入超稀疏MoE混合注意力架構。[3]
2026-02
發布Qwen3.5旗艦397B-A17B MoE模型,支援多模態代理功能。[1][3]
2026-02
發布Qwen3.5中型模型系列,包括35B-A3B與122B-A10B。[2]
2026-03
宣布停產小型Qwen3.5模型。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。