
GLM 5.1 新版本預告
Reddit r/LocalLLaMA 貼文以眼emoji 預告「GLM 5.1」。可能預示 Zhipu AI GLM 系列即將發布。新本地 LLM 進展引發社群期待。
Tag: #local-llm172 results

Reddit r/LocalLLaMA 貼文以眼emoji 預告「GLM 5.1」。可能預示 Zhipu AI GLM 系列即將發布。新本地 LLM 進展引發社群期待。
一位新手使用 WhatsApp 聊天記錄微調 Llama 3.1 3B-Instruct 模型,希望模仿個人打字風格,但模型會無端提及過去隨機事件,如數學考試。對簡單問候,它回覆無關查詢。使用者尋求修正建議。
用戶討論在雙 AMD 7900XT 工作站上運行 Qwen 3.5 27B 及更大模型的硬體升級選項。方案包括透過 AMD 9700 AI Pro 增加 VRAM,或透過 RTX 5090 提升頻寬。尋求加速編碼任務推論的建議。
Mac Mini(32GB)執行 unsloth gpt-oss-20b-Q4_K_S.gguf 的效能基準,使用 OpenClaw 2026.3.8 及 LM Studio。初始提示後達 34 令牌/秒解碼速度及 0.7 秒首令牌時間,脈絡達 26k。

Reddit r/LocalLLaMA 子版塊貼文宣布 MiniMax M2.7 即將推出。社群猜測它可能具備多模態功能。評論區正熱烈討論中。
Reddit 用戶詢問最佳 Qwen3.5-27B 量化模型(Q4-Q5,20-24GB),專為編碼任務優化。提及 Unsloth、bartowski 和 mradermacher 等候選。尋求正確比較方法建議。
Mac Mini 使用者讚揚 MLX 效能,但質疑其品質衰退。缺乏類似 GGUF 的模板與量化更新,Qwen 3.5 等模型收藏稀少,Discord 幾近死寂。尋求開發狀態洞見。
OpenCode 的網頁 UI 預設會將所有請求代理至 https://app.opencode.ai,無法真正本地運行。沒有旗標可停用此行為,導致防火牆後或注重隱私用戶的問題。多個 GitHub 問題顯示此問題。
貼文討論 Apple M5 Ultra 晶片的潛力。強調頻寬改善使更大模型更適合本地使用。好奇它將開啟的新機會。

用戶以 3 美元、10 分鐘微調 Qwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF,使用原數據集。結果:推理更乾淨、無冗餘,準確度維持或提升,對比有問題的原版。強調新手輕鬆微調潛力。