Search

Tag: #gguf30 results

Qwen3.5-27B Q4 量化排名比較

Qwen3.5-27B Q4 量化排名比較

對 Qwen3.5-27B GGUF 檔案的 Q4 量化進行全面比較,使用自訂聊天與 Wikitext2 數據集對 BF16 基線的 KLD。unsloth_Qwen3.5-27B-UD-Q4_K_XL 以最低 KLD 0.005087 領先。IQ4_XS 變體在 VRAM-大小平衡上效率最佳。

Reddit r/LocalLLaMACommunityMar 3#quantization#gguf#kld-benchmark
Qwen3.5-9B 在 Hugging Face 推出

Qwen3.5-9B 在 Hugging Face 推出

Unsloth 在 Hugging Face 發布 Qwen3.5-9B-GGUF,這是一款 9B 因果語言模型帶視覺編碼器。具備 Gated DeltaNet 等先進架構,並支援高達 100 萬 token 上下文長度。以多步驟 MTP 進行預訓練與後訓練。

Reddit r/LocalLLaMACommunityMar 2#gguf#long-context#9b
Page 2 of 3