🦙較早收集於 4h

Gemma 4 26b & E4B 取代 Qwen!

PostLinkedIn
🦙閱讀原文: Reddit r/LocalLLaMA
#semantic-routing#multi-gpu#model-comparisongemma-4gemma-4qwenclaude-codeopen-webui

💡Gemma 4 E4B 在 3090 上擊敗 Qwen 路由—完美本地 LLM 升級(24字元)

⚡ 30-Second TL;DR

有什麼變化

Gemma 4 E4B 修復 Qwen 3.5 4B 的語意路由失敗,甚至問候語也行。

為什麼重要

展示 Gemma 4 在本地多模型協調的優勢,讓消費級硬體實現生產級 AI 路由,減少雲端依賴。

下一步行動

在你的 Open-WebUI 設定中,將 Gemma 4 E4B 與 Qwen 進行語意路由基準測試。

誰應關注:Developers & AI Engineers

關鍵要點

  • Gemma 4 E4B 修復 Qwen 3.5 4B 的語意路由失敗,甚至問候語也行。
  • 取代任務專用 Qwen 模型(30b、27b、80b coder、122b 變體)。
  • 改善思考 token 效率及 Claude Code Router 中的工具呼叫。
  • 經 Llama-swap 與 Open-WebUI 在 2x RTX 3090 + P40、128GB RAM 運行。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。