🧧較早收集於 21m

Qwen Code SDK TypeScript v0.1.8-preview.0 發布

Qwen Code SDK TypeScript v0.1.8-preview.0 發布
PostLinkedIn
🧧閱讀原文: Qwen (GitHub Releases: qwen-code)

💡透過全新的多模態支援、批次執行功能與關鍵安全強化,提升您的 AI 代理開發能力。

⚡ 30-Second TL;DR

有什麼變化

為所有內容生成器新增了圖像、PDF 和音訊的多模態輸入支援。

為什麼重要

這些更新顯著提升了 Qwen Code 代理框架的穩定性與多功能性,使其更適合複雜的多模態開發工作流程。批次執行與 LSP 支援的加入,進一步提升了開發者在大型編碼任務中的生產力。

下一步行動

將您的 Qwen Code SDK 更新至 v0.1.8-preview.0,並在現有的代理工作流程中測試新的多模態輸入功能。

誰應關注:Developers & AI Engineers

關鍵要點

  • 為所有內容生成器新增了圖像、PDF 和音訊的多模態輸入支援。
  • 改進了針對 429/5xx 狀態碼的重試邏輯與錯誤處理機制。
  • 實作了用於 CLI 批次執行的並發運行器,並新增了實驗性 LSP 支援。
  • 透過 shell 指令驗證強化安全性,防止指令注入攻擊。

🧠 深度解析

Web-grounded analysis with 21 cited sources.

🔑 增強重點摘要

  • 多模態輸入支援已擴展至包含影片,並能自動切換至如 Qwen3-VL-Plus 等視覺語言模型,以進行高階視覺推理,處理 UI 設計、架構圖和錯誤截圖等任務.
  • 錯誤處理優化不僅限於重試邏輯,還擴展了對 OpenAI 相容 API 的支援,允許開發者根據特定需求靈活切換或試用不同的推理模型.
  • CLI 批次執行能力透過基於 Python 的並發執行器實現,該執行器利用隔離的 Git 工作樹進行多任務測試和基準測試,並能保存評估結果和執行軌跡.
  • 安全修復透過強化 shell 指令驗證來防止指令注入攻擊,具體做法是禁用指令鏈接並採用前綴匹配來允許指令,同時黑名單具有優先權.
  • SDK 引入了多種工具執行權限模式(例如 defaultplanauto-edityolo),讓開發者能更精細地控制 AI 代理對檔案系統和命令的修改權限.
📊 競品分析▸ Show
功能/產品Qwen CodeClaude Code (Anthropic)Gemini CLI (Google)
基礎模型Qwen3-Coder 系列模型Claude 3.5/4.5 Opus 系列模型Gemini 2.5 Pro/Flash 系列模型
上下文視窗256K-1M tokens (Qwen 3.6-Plus 預設 1M)大規模上下文視窗 (Claude 3.5)1 百萬 tokens
開源狀態CLI 和許多模型為 Apache 2.0 開源許可專有模型Apache 2.0 開源許可
多模態支援圖像、PDF、音訊、影片 (自動切換至 Qwen3-VL-Plus)支援多模態圖像、螢幕截圖
IDE 整合VS Code、Zed、JetBrains IDEs透過插件市場整合Google AI Studio、Workbench
代理能力專為代理工作流程優化,支援子代理和技能專為代理軟體開發設計,在代理能力和推理方面領先支援模型上下文協議 (MCP)
定價/可用性免費層級,API 按 token 付費,開源模型可本地部署按使用量付費 API,分級定價 (Haiku, Sonnet 3.5, Opus)提供免費層級,API 按 token 付費

🛠️ 技術深入

  • SDK 架構: Qwen Code TypeScript SDK 採用分層架構,包括 API 層、會話層、傳輸層和協議層,並透過 ProcessTransport 與 Qwen Code CLI 進行通訊。開發者可透過 TransportOptions 配置執行路徑、工作目錄、模型、權限模式等.
  • LSP 整合機制: 實驗性 LSP 支援透過連接到語言伺服器來提供程式碼智能功能,這些伺服器可透過 .lsp.json 檔案或擴展進行配置。它支援跳轉到定義、查找引用、診斷、程式碼操作和呼叫層次結構等功能.
  • 多模態處理: Qwen Code 能夠自動檢測輸入中的圖像並切換到 Qwen3-VL-Plus 等視覺語言模型進行處理,該模型具有高視覺推理能力和大型上下文視窗。Qwen-Audio 負責將音訊轉換為文本,而 Qwen3-VL 則支援影片 OCR、長影片理解和 3D 接地.
  • 安全指令驗證: 為了防止指令注入,shell 指令驗證機制會禁用指令鏈接(如 &&||;),並使用前綴匹配來允許指令。此外,黑名單中的指令具有優先權,即使它們與允許的前綴匹配也會被拒絕。執行時會設定 QWEN_CODE=1 環境變數.
  • 工具執行權限模式: SDK 提供了多種權限模式來控制 AI 代理的工具執行行為,包括 default(寫入工具需批准)、plan(AI 需先提出計畫)、auto-edit(自動批准編輯/寫入檔案工具)和 yolo(所有工具自動執行).

🔮 前景展望AI analysis grounded in cited sources

Qwen Code SDK 將加速多模態 AI 代理在開發工作流程中的普及。
透過提供對圖像、PDF、音訊甚至影片等多模態輸入的支援,SDK 使得開發者能夠更輕鬆地構建能夠理解和響應複雜、非文本數據的智能代理,從而將 AI 應用擴展到更廣泛的開發任務中.
強化安全性和精細的權限控制將提升企業對 AI 程式碼生成工具的信任和採用率。
禁用指令鏈接、前綴匹配驗證以及多種工具執行權限模式(如 plan 模式)直接解決了開發者對 AI 代理意外修改程式碼的擔憂,使其在敏感的企業環境中更具吸引力.
實驗性 LSP 支援的成熟將使 Qwen Code SDK 成為更深層次 IDE 整合和上下文感知程式碼輔助的關鍵工具。
LSP 能夠提供精確的程式碼智能功能,如定義跳轉和診斷,這將使 AI 代理能夠更深入地理解程式碼語義,從而提供更準確和有用的輔助,並可能導致更緊密的 IDE 插件和開發者工具整合.

時間線

2023-04
阿里巴巴推出 Qwen (通義千問) 的 Beta 版
2023-09
Qwen 模型在獲得監管批准後開放公眾使用
2024-06
Qwen2 系列模型發布
2025-07
Qwen3-Coder 作為開源代理程式碼模型發布
2025-12
Qwen Code v0.5.0 發布,引入原生 TypeScript SDK 和 VSCode 整合
2026-02
Qwen Code v0.8.1/v0.8.2 穩定版和 v0.9.0 預覽版發布,新增 LSP 支援和批次執行工具
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Qwen (GitHub Releases: qwen-code)