
本地編碼模型達到2025雲端SOTA水準
開源27B-32B模型在Terminal-Bench 2.0上測試,Qwen 3.6-27B在預設超時下得分38.2%。此表現相當於2025年底的雲端前沿模型如Claude Opus 4.1。MOE模型推理速度大幅提升。
Tag: #open-weight21 results

開源27B-32B模型在Terminal-Bench 2.0上測試,Qwen 3.6-27B在預設超時下得分38.2%。此表現相當於2025年底的雲端前沿模型如Claude Opus 4.1。MOE模型推理速度大幅提升。

Qwen 3.6 27B 在 Artificial Analysis 的代理指數上與 Sonnet 4.6 不相上下,超越 Gemini 3.1 Pro Preview、GPT 5.2、GPT 5.3 和 MiniMax 2.7。它在所有指數上都有進步,訓練重點放在如 OpenClaw/Hermes 的代理應用。小型模型逼近前沿性能,122B 版本可能更強。

Mistral AI 推出 Voxtral TTS,這是專為企業設計的頂尖品質開放權重文字轉語音模型,聲稱優於 ElevenLabs。模型權重免費下載,讓企業可在自家伺服器或智慧型手機上運行,無需依賴第三方。此模型完善 Mistral 的企業自有 AI 堆疊,包括端到端語音轉語音管道。
中國的開放權重 AI 模型正促使美國企業重新思考建立在專有優勢上的策略。Nvidia 與 Meta 發布相關模型,顯示若要維持持久的美國領先地位,可能需要更廣泛地開放高能力模型。

Alibaba 宣稱 Qwen 模型下載量已超過 30 億次,成為全球使用最廣泛的開放權重模型家族。然而,Hugging Face 統計今年 Qwen 下載量為 20.45 億次、衍生模型為 151,448 個,低於 Alibaba 所稱的超過 30 萬個衍生模型。

Google DeepMind 的 Gemma 4 模型系列現已於 Amazon Bedrock 上架。此次發布包含三種經過指令微調的變體,涵蓋密集架構與混合專家模型 (MoE),並具備多模態處理能力。

Zyphra 推出 ZAYA1-8B,宣稱 8B 模型具前沿智能密度。已在 Hugging Face 與 Zyphra 部落格上線。針對高效本地 AI 需求。

AgentFloor 是全新 30 項任務基準測試,涵蓋六階代理工作流程,從指令遵循到長程規劃。小型開源模型(0.27B-32B)足以處理常規工具使用,總體匹配 GPT-5 且更便宜。先進模型在複雜規劃中表現優異,並釋出基準與結果。

Granite-4.1-8B 是從基礎模型微調的 8B 指令模型,經改善後訓練包含 SFT 及 RL 對齊。強化工具呼叫、指令遵循及聊天,用於 AI 助理及代理。支援 13 語言、Apache 2.0 授權,2026 年 4 月 29 日發布。

EXAONE 4.5-33B 以多種格式發布,包括 FP8 和 GGUF 以利高效推理。LGAI-EXAONE 的 Hugging Face 儲存庫立即可用。針對本地部署和量化用戶。