Search

Tag: #local-inference188 results

🤖

尋找 LLM 量化的最佳位元寬度

一名 Reddit 使用者詢問,在固定記憶體與運算預算下,目前的理論或實證研究是否已找出 LLM 最佳的每權重位元數。討論比較以 3-bit、2-bit 或約 1.5-bit 精度運行的大型模型,與採用 4-bit 或 8-bit 的較小模型,並特別關注 GGUF 等開源格式。

Reddit r/MachineLearningCommunityAug 7#quantization#bits-per-weight#scaling-laws
Page 17 of 19