來源較早收集於 4h

Gemma 4 26b & E4B 取代 Qwen!

閱讀原文: Reddit r/LocalLLaMA
#semantic-routing#multi-gpu#model-comparison

Gemma 4 E4B 在 3090 上擊敗 Qwen 路由—完美本地 LLM 升級(24字元)

30 秒速覽

有什麼變化

Gemma 4 E4B 修復 Qwen 3.5 4B 的語意路由失敗,甚至問候語也行。

為什麼重要

展示 Gemma 4 在本地多模型協調的優勢,讓消費級硬體實現生產級 AI 路由,減少雲端依賴。

下一步行動

在你的 Open-WebUI 設定中,將 Gemma 4 E4B 與 Qwen 進行語意路由基準測試。

誰應關注:Developers & AI Engineers

關鍵要點

  • •Gemma 4 E4B 修復 Qwen 3.5 4B 的語意路由失敗,甚至問候語也行。
  • •取代任務專用 Qwen 模型(30b、27b、80b coder、122b 變體)。
  • •改善思考 token 效率及 Claude Code Router 中的工具呼叫。
  • •經 Llama-swap 與 Open-WebUI 在 2x RTX 3090 + P40、128GB RAM 運行。

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA ↗

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。