Search

Tag: #model-optimization39 results

🤖

Qwen3.5 運行筆記與最佳設定

Reddit 用戶分享 Qwen3.5 模型系列的親身運行經驗,強調其一致的家族特徵、對提示的高度適應性,以及在 llama.cpp 中的設定敏感度。主要建議包括 35B 模型使用 temp 0.6、repeat-penalty 1.4 以防循環,並避免 KV 快取量化。模型透過系統提示可在表面回應外展現更深入分析。

Reddit r/LocalLLaMACommunityFeb 28#local-inference#prompting-tips#model-optimization
Page 4 of 4