
DeepSeek V4 距全球最強 AI 落後 7 個月
DeepSeek V4 發布一周,連續三次降價並推出視覺大模型,完成本代布局。但不如前代 R1 技術領先,AI 榜單落後美國公司模型。美國研究員公布結果:落後全球最強 AI 約 7 個月,如 GPT-5.5、Opus 4.7 及 Gemini 3.1 Pro。
Tag: #llm-comparison7 results

DeepSeek V4 發布一周,連續三次降價並推出視覺大模型,完成本代布局。但不如前代 R1 技術領先,AI 榜單落後美國公司模型。美國研究員公布結果:落後全球最強 AI 約 7 個月,如 GPT-5.5、Opus 4.7 及 Gemini 3.1 Pro。

許多用戶正從 ChatGPT 轉向 Claude,但新報告挑戰此趨勢。測試顯示兩者皆非最強免費 AI,表現依任務而異。一款驚喜模型在特定基準測試中勝出。

本文評估了 ChatGPT 與 Claude 在透過 Instacart 進行日常購物時的實際差異。文章強調了不同 AI 模型在現實應用場景中,如何提供截然不同的使用者體驗與任務處理能力。
一位使用者分享了從 Microsoft Copilot 轉向 Google Gemini 的經驗,指出後者在技術故障排除與研究準確性上表現更佳。作者強調與 Gemini 相比,Copilot 更容易出現幻覺並提供過時資訊。
Hermes因開發者優先穩定執行而爆紅,勝過原始威力。「全腦」AI方法被保守可靠途徑超越。OpenClaw因穩定性不足無奈讓位。

作者尋找更好 AI 後,從 ChatGPT 轉付費 Claude。它從好奇轉為每日工作必需,改變工作流程。分享三個偏好理由。

作者駕駛時測試 ChatGPT 與 Perplexity AI 作為 CarPlay 語音助理。兩者皆遠超 Siri 的提問回答與幫助能力。其中一模型整體表現更優。