Search

Tag: #local-inference188 results

🤖

Qwen3.5-35B GGUF 量化基準測試

基準測試比較 Hugging Face 上 Qwen3.5-35B GGUF 量化版本(16-22 GiB)的 KLD 差異和速度。使用多語言 FLORES 200 和校準資料集。表格依 KLD 平均值和 99% 排名,在 RTX 3090 上 TG/s 最高達 143。

Reddit r/LocalLLaMACommunityMar 16#quantization#benchmarks#kld
Page 10 of 19