Search

Tag: #quantization201 results

🔬

RaBitQ 作者澄清 TurboQuant 誤述

RaBitQ 論文作者公開澄清 TurboQuant 對其方法的描述不完整且不準確,包括理論保證和實證比較。他們強調遺漏如隨機旋轉等關鍵步驟,以及不當的次優聲明,儘管先前已通知。貼文旨在糾正本地 LLM 推論社群在 ICLR 2026 前夕的混淆。

Reddit r/LocalLLaMACommunityMar 30#kv-cache#quantization#iclr-2026
🤖

家用實驗室整合至 122B Qwen MoE

使用者在 Strix Halo 上基準測試並將家用實驗室從三個模型整合至單一 122B Qwen3.5 MoE,達到 27.4 tok/s 並獲最高分數。IQ3 量化在半 VRAM 下性能匹配 Q4_K_M。同時處理電子郵件、財務和攝像頭等多個應用。

Reddit r/LocalLLaMACommunityMar 27#homelab#moe#quantization
Page 13 of 21