
DeepSeek 預覽接近前沿模型
DeepSeek 預覽新型 AI 模型,在效率與效能超越 V3.2。架構改進使推理基準接近前沿模型。挑戰開放與封閉領先模型。
Tag: #model-preview8 results

DeepSeek 預覽新型 AI 模型,在效率與效能超越 V3.2。架構改進使推理基準接近前沿模型。挑戰開放與封閉領先模型。
Anthropic 推出新 AI 模型 Mythos,宣稱其為網路安全的「清算」。公司延後公開發布,並與 40 家公司合作,探索其防止網路攻擊的潛力。

Qwen 3.6 Plus 預覽版出現在 OpenRouter.ai 上。這暗示 Alibaba Qwen 開源模型系列即將發布。在 r/LocalLLaMA 貼文。

阿里巴巴推出 Qwen3.5-Max-Preview,其最強 AI 模型,在 Arena 基準測試中超越所有中國對手,但落後 Anthropic、Google 和 OpenAI 等美國對手。此 Qwen 3.5 系列預覽版鞏固了阿里巴巴在中國 AI 競賽中的領先地位。

MiniMax M2.7 在 DesignArena 洩漏,並來自迅速移除的網站文件。r/LocalLLaMA 的 Reddit 貼文分享預覽圖像。目前尚無模型能力的進一步細節。

騰訊混元Hy3 preview 接受實測,標誌模型重新出發。代表大模型產業轉向務實中型模型。競爭激烈的中型模型務實之戰。

DeepSeek網頁與APP連崩兩次,持續10小時,已恢復。視為V4衝擊波有益壓力測試,梁文鋒需準備。
小米即將推出的 MiMo V2 Pro 模型基準測試已洩漏線上。資料託管於 artificialanalysis.ai,並透過 Reddit r/LocalLLaMA 分享。新模型包含效能指標細節。