🐯虎嗅•較早收集於 10m
Qwen 負責人林俊旸離開阿里

💡Qwen 負責人離職預示阿里 AI 策略轉變;趁不確定性前搶開源模型 (38 字)
⚡ 30-Second TL;DR
有什麼變化
Qwen 技術負責人林俊旸在 Qwen 3.5 發布及馬斯克讚揚後離職。
為什麼重要
Qwen 未來不確定,關鍵人員離開可能減緩創新,阿里轉向商業化。利好字节等競爭者;凸顯開源理想與商業壓力衝突。
下一步行動
立即從 Hugging Face 下載 Qwen 3.5 模型,以防開發放緩。
誰應關注:Developers & AI Engineers
關鍵要點
- •Qwen 技術負責人林俊旸在 Qwen 3.5 發布及馬斯克讚揚後離職。
- •阿里將 Qwen 團隊拆分成水平功能團隊,縮減林俊旸權限。
- •Qwen 從 0.5B 到 72B 全開源模型,下載超 6 億,衍生 17 萬個。
- •團隊整合與商業化衝突;多名 Qwen 骨幹同時離開。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 8 個來源。
🔑 增強重點摘要
📊 競品分析▸ Show
| 特徵/基準 | Qwen | GPT-4o | Claude 3.5 | DeepSeek-V3 |
|---|---|---|---|---|
| 多模態能力 | 支持文字、影像、音頻、視頻;Qwen2.5-VL處理複雜場景 [1][2] | 支持多模態 [6] | 支持多模態 [6] | 多模態但Qwen2.5-Max超越 [6] |
| 推理模型 | QwQ-32B在部分基準優於o1 [5][6] | o1-preview [6] | - | - |
| 代碼生成 | Qwen3-Coder MoE優於SWE-bench [4] | 領先專有模型 [4] | 領先專有模型 [4] | Qwen2.5 Coder 32B相當 [6] |
| 開源策略 | 全系列開源,HuggingFace領先 [2][4] | 部分專有 [5] | 部分專有 [4] | 開源但Qwen超越 [6] |
🛠️ 技術深入
- •Qwen模型參數規模從0.5B至72B,支持多模態(文字、音頻、視覺),訓練於超過3兆token,在多任務準確率與代碼生成基準優於多數開源模型。[1]
- •Qwen2.5系列擴大參數規模,提升照片/視頻理解、大規模音頻語言模型,並降低Qwen-Plus與Qwen-Turbo的強推理成本。[1]
- •Qwen3-VL系列(2B與32B)處理影像辨識、OCR、視頻理解與AI Agent任務,性能超越GPT-5 mini與Claude 4 Sonnet。[4]
- •QwQ-32B-Preview為32B參數推理模型,上下文長度32K,在部分基準優於OpenAI o1,僅開放權重而非資料集或訓練方法。[5]
- •Qwen2.5-1M支持1百萬token長上下文輸入。[2]
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
2023-04
阿里推出Qwen模型家族並獲監管許可
2023-08
發布首個開源模型Qwen-7B與Qwen-7B-Chat
2024-06
推出Qwen2系列,包括密集與稀疏模型
2024-11
發布推理模型QwQ-32B-Preview
2025-01
發布Qwen2.5-VL視覺語言模型與Qwen2.5-1M長上下文模型
2025-06
發布Qwen 3.5 Small系列多模態模型
📎 來源 (8)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰 事件追蹤
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅 ↗
每週 AI 簡報
每週一封,可隨時退訂。

