
傳 Google Gemini 3.5 Pro 將於 7 月 17 日發布
據傳 Google 計劃於 7 月 17 日發布 Gemini 3.5 Pro,具備 200 萬 token 上下文窗口及全新的「深度思考」推理模式。早期測試顯示其在編碼任務與智能體工作流表現優於 Claude Fable 5。
Tag: #long-context85 results

據傳 Google 計劃於 7 月 17 日發布 Gemini 3.5 Pro,具備 200 萬 token 上下文窗口及全新的「深度思考」推理模式。早期測試顯示其在編碼任務與智能體工作流表現優於 Claude Fable 5。

本地 LLM 部署的突破:混合 Mamba+MoE 模型在消費級硬體 (4x3090) 上實現了高達 504K token 的完美檢索。該架構使用固定大小的循環狀態來避免 KV 快取膨脹。

Z.ai 推出了 GLM-5.2,這是一款擁有 7,530 億參數的開源權重模型,專為長跨度編碼任務進行了優化。該模型具備 100 萬 token 的上下文窗口,並採用全新的 IndexShare 架構,大幅降低了運算成本。

Zhipu AI 以 MIT 授權發布了 GLM-5.2,具備 100 萬 token 的超長上下文視窗。此舉被視為針對美國出口限制影響 Anthropic 模型取得管道的策略性回應。

USTC 研究人員發布了一種新型代理驅動的訓練範式,使 30B 參數模型能達到 Alibaba 235B Qwen3 模型的性能。此突破顯著提升了長文本語言模型的訓練效率。

MiniMax 推出了 MiniMax Sparse Attention (MSA),這是一種支援原生 1M token 上下文視窗的架構。透過重組記憶體存取模式並避開標準的二次方複雜度,該架構實現了顯著的速度提升。

AI 代理領域近期取得進展,特別是 Anthropic 的「Claude Mythos Preview」與 OpenAI 的「GPT-5.5」,在處理長時間自主任務的能力上表現優異,超出了研究人員的預期。
NVIDIA 推出 Nemotron 3 Nano Omni,這是一款緊湊的長上下文多模態模型,用於建構處理文件、音頻和視頻的智能代理。該模型託管於 Hugging Face,推進高效多模態 AI 能力。此發布針對尋求輕量但強大解決方案的代理開發者。

Zhipu AI 的 GLM-5.1 現已上線供 Coding Plan 用戶使用,在 SWE-bench-Verified 達 77.8 分、Terminal Bench 2.0 達 56.2 分,領先開源模型。編碼能力媲美 Claude Opus 4.5、超越 GPT-4o,支持 200K 上下文與代理工作流程。