🦙較早收集於 4h

Qwen 3.5 小型模型今日推出

Qwen 3.5 小型模型今日推出
PostLinkedIn
🦙閱讀原文: Reddit r/LocalLLaMA
#model-release#open-source-llm#local-deploymentqwen-3.5-smallqwen-3.5-small

💡全新 Qwen 3.5 small 推出 – 適合高效本地推理測試(24字)

⚡ 30-Second TL;DR

有什麼變化

Qwen 3.5 小型模型正式於今日推出

為什麼重要

擴展 Qwen 系列小型模型,利於本地部署,加速開源 LLM 普及。

下一步行動

造訪 r/LocalLLaMA 討論串,下載並測試 Qwen 3.5 small。

誰應關注:Developers & AI Engineers

關鍵要點

  • Qwen 3.5 小型模型正式於今日推出
  • r/LocalLLaMA 子版塊分享爆料新聞
  • 包含貼文與評論連結以獲取細節

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 6 個來源。

🔑 增強重點摘要

  • Qwen3.5系列於2026年2月24日由Alibaba Qwen團隊發布,包括Qwen3.5-122B-A10B、Qwen3.5-35B-A3B及Qwen3.5-27B等中型模型,強調高效能與低計算需求[1][6]
  • Qwen3.5-397B-A17B為系列首個開放權重模型,支持原生多模態及262k token上下文長度,具備空間智能與代理能力[2][4][5]
  • Qwen3.5-35B-A3B在效能超越舊版Qwen3-235B-A22B,並引入Gated DeltaNet + Gated Attention混合機制以支援長上下文[1][3]
  • 系列具備1M上下文長度、內建工具使用及代理功能,適用於高吞吐量、低延遲生產環境[1]
📊 競品分析▸ Show
特徵/模型Qwen3.5-35B-A3BQwen3-235B-A22BGLM-5MiniMax M2.5
參數規模35B (A3B)235B (A22B)~400B~400B
上下文長度1M32k (原生)未指定未指定
效能基準超越235B基準代理編碼相當代理編碼相當
多模態是 (系列支援)分離VL模型未指定未指定

🛠️ 技術深入

  • 採用Qwen3 Next架構:相較前代235B-A22B,專家數增加4倍並新增共享專家,模型規模縮小3倍[3]
  • 注意力機制替換為Gated DeltaNet + Gated Attention混合,提升記憶體效率以支援262k token原生上下文[3]
  • 強化學習(RL)優化,Qwen3.5-Flash為35B-A3B的生產版,針對代理工作流低延遲設計[1]
  • 內建原生工具呼叫、函數呼叫及API互動,支援多模態代理應用[1][2][4]
  • Qwen3.5-397B-A17B具4.3%稀疏率,稀疏度低於Kimi的3.25%[2]

🔮 前景展望AI analysis grounded in cited sources

小型Qwen3.5變體將推動消費者硬體本地部署
Qwen團隊剛發布小型模型變體,延續Qwen3在80B以下模型的本地使用優勢,並針對on-device情境優化[3]
中國開源模型將在代理編碼基準追平國際領先者
Qwen3.5在SWE-Bench等代理編碼基準上與GLM-5及MiniMax M2.5相當,顯示中國實驗室持續縮小差距[3]

時間線

2026-02
Qwen3.5系列發布,包括397B-A17B開放權重模型
2026-02-24
發布Qwen3.5-122B-A10B、35B-A3B及27B中型模型
2026-03-01
Qwen 3.5小型模型正式推出
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。