
阿里巴巴 Qwen3.7-Max 在程式編寫能力上超越 OpenAI 與 Google
阿里巴巴最新的 AI 模型 Qwen3.7-Max 在全球 Code Arena 排行榜上奪得第四名。它是除 Anthropic 之外唯一進入前五名的開發者,顯示了程式編寫大型語言模型競爭格局的重大轉變。
Tag: #coding-assistant48 results

阿里巴巴最新的 AI 模型 Qwen3.7-Max 在全球 Code Arena 排行榜上奪得第四名。它是除 Anthropic 之外唯一進入前五名的開發者,顯示了程式編寫大型語言模型競爭格局的重大轉變。

阿里巴巴的 Qwen 3.7 模型在全球編程基準測試中獲得了頂尖排名。目前其表現僅次於 Claude,標誌著中國大型語言模型的重要里程碑。

據報導,DeepSeek 正在開發中國版 Claude Code,旨在利用類似蜜雪冰城(Mixue Bingcheng)的高效、低成本策略。此舉標誌著其正積極擴張至 AI 程式碼輔助工具市場。

DeepSeek 正準備推出其專用的程式設計模型 DeepSeek Code。該項目由 ACM 金牌得主崔添翼領軍,並獲得了巨額資金支持。

Anthropic 在 Claude Code 推出語音模式。此功能為 AI 程式設計輔助增添語音能力。它強化 Anthropic 在 AI 程式設計市場的地位。

Codex 已正式移除 5 小時使用限制,讓開發者能進行更連續的工作流程。此外,Fable 5 的訂閱期限也額外延長了 7 天。

月之暗面宣布 K2.7 Code 高速版模型結束 Beta 測試,正式成為常駐模式。該模型輸出速度較標準版提升 5-6 倍,專為高強度編程任務優化。

Google 全面翻新了 Android Bench 排行榜,並導入了全新的測試框架。此次更新加入了八款新的 AI 模型,旨在更精確地評估 Android 開發的編碼效能。

本次更新重點在於將 xAI 的 Grok 整合至 Cursor 程式碼編輯器中。同時也提及了關於 GPT-5.6 的進展以及 ChatGPT 語音介面的更新。
開發者回報在使用 Qwen3.6-27B 管理大型程式碼庫時出現越來越多的錯誤,並尋求提高模型準確性與上下文處理的策略。