Search

Tag: #benchmarks166 results

開源 LLM 僅差專有模型 5 品質分

開源 LLM 僅差專有模型 5 品質分

whatllm.org 2026 年 1 月報告基準測試 94 個 LLM 端點,顯示開源模型品質指數僅落後專有領導者 5 分。頂尖開源如 GLM-4.7(68 QI)和 DeepSeek V3.2 匹敵 Gemini 3 Pro(73 QI)和 GPT-5.2。開源大幅降低成本,如 $0.30/M 對比 $3.50/M,差距從年初的 12 分縮減。

Reddit r/MachineLearningCommunityMar 1#benchmarks#inference-costs#open-source-llms
Page 10 of 17