來源Reddit r/LocalLLaMA•較早收集於 4h
Gemma 4 在本地測試勝過 Qwen
#local-inference#benchmark#quantizationgemma-4gemma-4qwen-3.5llama.cppmlx-vlm
💡Gemma 4 本地壓制 Qwen:Mac Studio 速度與智慧並進
⚡ 30 秒速覽
有什麼變化
Gemma 26b a4b:在 Mac Studio 20k 上下文 ~1000pp、~60tg
為什麼重要
將 Gemma 4 定位為本地推論頂尖開源模型,因可用性及連貫性優於 Qwen 吸引使用者。KV 快取問題可能限制長上下文應用,直至修復。
下一步行動
使用 llama.cpp 在 Mac Studio 20k 上下文基準測試 Gemma 4 26b Q4_K_XL 對 Qwen3.5。
誰應關注:Developers & AI Engineers
關鍵要點
- •Gemma 26b a4b:在 Mac Studio 20k 上下文 ~1000pp、~60tg
- •簡潔連貫思考鏈,對比 Qwen 的迴圈與自我否定
- •優秀視覺理解及多語言表現
- •KV 快取龐大無優化;mlx-vlm 對 Qwen 提示快取失效
- •e4b 變體審查嚴重
📰 事件追蹤
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA ↗
每週電子報
每週一封,可隨時退訂。