Search

Tag: #local-inference187 results

透過裁剪層打造更小的 Qwen3.8

透過裁剪層打造更小的 Qwen3.8

一名社群開發者透過策略性移除 Qwen3.8-27B 的層,製作出約 22.7B 參數的 Qwen3.8-23B-Mini-Me,且推理能力沒有嚴重退化。據稱該模型適合程式設計、代理任務與多輪對話,但尚未進行基準測試,在邊界案例與資訊不完整的提示上較弱。

Reddit r/LocalLLaMACommunity2d ago#model-pruning#model-compression#apple-silicon
Page 1 of 19