🧧Qwen (GitHub Releases: qwen-code)•最新收集於 19m
Qwen Code 強化 Web Shell 工作流程
💡了解 Qwen Code 如何改善代理審查、私人 Git 工作流程、模型推理與 Web Shell 效能。
⚡ 30-Second TL;DR
有什麼變化
Web Shell 現在可透過撰寫器或 @ 選取插入檔案,並提供預覽、佇列管理與持久化儲存。
為什麼重要
此版本讓 Qwen Code 更適合長時間執行的代理任務、私人儲存庫與反覆程式碼審查。開發者在管理檔案與工作階段時,應能減少審查中斷並獲得更順暢的 Web Shell 體驗。
下一步行動
將 Qwen Code 升級至 v0.21.15,並在審查或 CI 工作流程中測試 /resume,再使用私人儲存庫驗證經驗證的 HTTPS Git 擴充功能安裝。
誰應關注:Developers & AI Engineers
關鍵要點
- •Web Shell 現在可透過撰寫器或 @ 選取插入檔案,並提供預覽、佇列管理與持久化儲存。
- •穩定版 qwen3.8-max 模型可透過 /model 使用,Qwen 混合模型也提供簡易的 Thinking 推理切換。
- •--resume 旗標可讓 /review、審查執行與 CI 重試在 PR head 未變更時繼續中斷的審查。
- •經驗證的 HTTPS Git 擴充功能安裝支援可設定的憑證持久化,方便複製私人儲存庫。
- •工具核准與詢問使用者對話框現在以符合聊天寬度的底部工作表呈現,同時修正 /rewind 與重複工具呼叫 ID 錯誤。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 19 個來源。
🔑 增強重點摘要
- •Qwen Code作為一個終端機介面(CLI)工具,旨在讓開發者在不離開其開發環境的情況下,直接在終端機中執行程式碼生成、偵錯、程式碼庫導航和自動化任務。
- •Qwen Code支援多種大型語言模型,包括Qwen3-Coder-Plus,並具備與OpenAI、Anthropic、Gemini相容API的整合能力,同時也支援透過Ollama或llama.cpp進行本地推理。
- •Qwen模型家族(如Qwen3系列)引入了「思考模式」和「非思考模式」的混合推理機制,允許模型根據任務複雜度在深度推理和快速響應之間動態切換,並可透過「思考預算」進行資源分配。
- •Qwen Code是一個開源專案,這為開發者提供了高度的透明度和控制權,使其能夠在注重資料隱私的環境中進行客製化或自託管部署。
- •Qwen Code可利用的旗艦模型Qwen3.8-Max是一個擁有2.4兆總參數和950億活躍參數的稀疏混合專家(MoE)模型,支援高達100萬token的上下文視窗,並原生處理文字、圖像和影片等多模態輸入。
📊 競品分析▸ Show
| 特性/模型 | Qwen Code (Qwen 3.8 Max) | Gemini 5 | GPT-5.6 Sol | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|---|
| DeepSWE 基準 | 56.6 | 70 | 73 | 59 | N/A |
| Terminal-Bench 2.1 基準 | 86.6 | N/A | N/A | 84.6 | 84.6 |
| OSWorld-Verified 基準 | 86.1 | 76.2 | 83.2 | N/A | 85.0 |
| 定價 (每百萬Token) | 輸入: $2.00, 輸出: $6.00 (API);CLI開源免費 | N/A | N/A | N/A | N/A |
| 模型架構 | 2.4兆參數MoE,950億活躍參數 | N/A | N/A | N/A | N/A |
| 上下文視窗 | 100萬 Token | N/A | N/A | N/A | N/A |
| 多模態支援 | 文字、圖像、影片 | N/A | N/A | N/A | N/A |
🛠️ 技術深入
- Qwen模型家族基於Transformer架構,並在注意力機制、訓練方法和多語言能力方面進行了創新。
- Qwen3系列包含密集型和混合專家(MoE)架構模型,參數規模從0.6B到235B不等。
- Qwen3-235B-A22B MoE模型總參數為2350億,每個token激活220億參數,採用分組查詢注意力(GQA)、SwiGLU、旋轉位置嵌入(RoPE)和帶預歸一化的RMSNorm。
- Qwen3.8-Max模型總參數達2.4兆,其中950億為活躍參數,隱藏維度為8192,Token嵌入為248,320(填充),共92層。
- Qwen3.8-Max的原生上下文長度為262,144個token,可擴展至1,010,000個token,並原生支援文字、圖像和影片輸入。
- Qwen模型引入了「思考模式」(用於複雜多步驟推理)和「非思考模式」(用於快速響應)的整合框架,並具備「思考預算」機制,允許用戶動態分配計算資源以平衡延遲和效能。
- Qwen3模型在預訓練階段使用了約36兆個token的資料集,涵蓋119種語言和方言,而Qwen3.5則擴展至201種語言。
- Qwen Code CLI工具支援互動模式和無頭模式,可以直接編輯檔案、執行命令和建立提交,並透過內建工具(如Skills、SubAgents)實現代理工作流程,與本地環境互動。
- 針對潛在的敏感操作(如修改檔案系統或執行命令),Qwen Code實施了安全措施,包括要求使用者確認和沙盒化執行。
🔮 前景展望AI analysis grounded in cited sources
Qwen Code的持續開源策略及其模型架構的靈活性將加速AI輔助開發工具的普及和客製化。
開源性質降低了採用門檻,並允許開發者根據特定需求進行修改和部署,從而推動更廣泛的應用和創新。
隨著Qwen模型在長上下文、多模態和代理能力方面的進步,AI將能夠更自主地處理複雜的軟體工程任務,減少人類開發者的介入。
增強的推理、多模態輸入處理和代理執行能力使AI能夠理解並完成從需求分析到程式碼部署的更廣泛、更複雜的開發流程。
Qwen Code的「思考模式」與「非思考模式」切換功能,結合可配置的「思考預算」,將促使開發者更精確地平衡AI輔助的成本與效能。
這種靈活的控制機制允許用戶根據任務複雜度選擇最佳的推理深度,從而優化資源使用和響應時間。
⏳ 時間線
2023-04
阿里巴巴推出Qwen(通義千問)的測試版。
2023-08
Qwen-7B及其聊天模型發布。
2023-09
Qwen向公眾開放,並發布Qwen-14B及其聊天模型。
2023-11
Qwen-72B和Qwen-1.8B模型發布,支援32k上下文。
2025-04
Qwen3模型家族發布,包含密集型和MoE模型,並引入思考模式與非思考模式。
2026-04-15
Qwen Code的免費託管OAuth推理服務終止。
2026-08-03
Qwen3.8-Max雲端版本發布。
2026-08-12
Qwen3.8-Max的開源權重版本Qwen3.8-2.4T-A95B發布。
📎 來源 (19)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Qwen (GitHub Releases: qwen-code) ↗
每週 AI 簡報
每週一封,可隨時退訂。
