
Qwen3.5-9B 編碼基準測試領先
Reddit 貼文討論 Qwen3.5-9B 是否足夠用於代理編碼。它在所有編碼項目擊敗 Qwen3-30B-A3B,並與 Qwen3-Next-80B/GPT-OSS-20B 匹敵多項。針對 8GB VRAM 筆電,使用 Q8 量化與長上下文。
Tag: #coding-benchmarks12 results

Reddit 貼文討論 Qwen3.5-9B 是否足夠用於代理編碼。它在所有編碼項目擊敗 Qwen3-30B-A3B,並與 Qwen3-Next-80B/GPT-OSS-20B 匹敵多項。針對 8GB VRAM 筆電,使用 Q8 量化與長上下文。
SanityBoard 更新新增 27 項評測結果,包括 Qwen3.5 Plus、GLM 5、Gemini 3.1 Pro、Sonnet 4.6 及三個 OSS 程式碼代理。社群投稿強調 GPT-codex 在迭代任務的優勢。新增 UI 改善如日期滑桿,並註明基礎設施變異性。