
DeepSeek V4 Pro 基準表現遜色,網路安全能力突出
DeepSeek 悄悄發布 DeepSeek-V4-Pro-0813,這是其 4 月預覽版模型的更新版本,並宣稱大幅提升代理能力。初步反應顯示,該模型在整體基準測試與定價方面未如預期,但在網路安全等利基應用中表現亮眼。
Tag: #model-benchmarks14 results

DeepSeek 悄悄發布 DeepSeek-V4-Pro-0813,這是其 4 月預覽版模型的更新版本,並宣稱大幅提升代理能力。初步反應顯示,該模型在整體基準測試與定價方面未如預期,但在網路安全等利基應用中表現亮眼。
2026 年 8 月的 r/LocalLLaMA 討論聚焦於開放權重模型的快速進步,包括部分模型據稱能在實用硬體上媲美封閉式前沿系統。文章邀請使用者針對一般用途、代理式編程、創意工作與特殊應用分享推薦。
Reddit 使用者分享在 Mac Studio 上運行 LLM 的實務經驗,讚揚 GLM 5.1 適合 6/10 級以下編碼,Kimi K2.6 速度快但記憶體需求高,Qwen 3.5 9B 適合高效多模態任務。指出 Gemma 4 31B 支援問題,並期待 Deepseek/Mimo 整合。關注 Exo、tinygrad 及新型量化格式等未來工具。
使用者讚揚 Qwen3.6-397B-A17B 在真實任務中達到 Claude Sonnet 可靠性,優於 GLM-5.1 及 Kimi-k2.5。呼籲開源以支援本地執行、雲端租用及無審查修改。首個感覺可比頂級封閉模型的開源模型。