
Sarvam 105B 在印度知識測試失利
使用者比較印度脈絡訓練的 Sarvam 105B、ChatGPT 及 Gemini,測試梨俱吠陀-因陀羅及薩摩吠陀-克里希那事實。Sarvam 失敗,而 ChatGPT 及 Gemini 成功,凸顯訓練缺口。
Tag: #model-comparison43 results

使用者比較印度脈絡訓練的 Sarvam 105B、ChatGPT 及 Gemini,測試梨俱吠陀-因陀羅及薩摩吠陀-克里希那事實。Sarvam 失敗,而 ChatGPT 及 Gemini 成功,凸顯訓練缺口。
資深工程師質疑Qwen 3.5 122B/27B等本地LLM是否適合雲端模型被禁的專業編碼工作。與GPT-5/Codex等頂級雲端模型比較。討論Mac M5 128GB RAM是否足夠。
Reddit 用戶讚揚 GPT-4.1 為可靠預設模型,擅長指令遵循和長上下文處理。他們希望 OpenAI 如先前 GPT-OSS 模型般開源它,特別因其優異 RAG 效能。Mini 變體提供極高價值。