
AI 競爭趨勢:模型強度與上下文窗口
AI 領域正迅速發展,一個顯著的趨勢是模型能力的增強伴隨著更短、更高效的上下文窗口。這種轉變影響了開發者處理長上下文任務的方式。
Tag: #context-window28 results

AI 領域正迅速發展,一個顯著的趨勢是模型能力的增強伴隨著更短、更高效的上下文窗口。這種轉變影響了開發者處理長上下文任務的方式。
作者分享了為程式編寫代理構建主動式上下文管理系統的經驗,強調資訊密度比單純的上下文壓縮更重要。該專案採用多層次記憶架構與語義檢索,以維持代理的專注度。

OpenAI 升級了 ChatGPT 的記憶能力,並針對免費版使用者進行了顯著優化。此次更新涉及對聊天機器人底層「夢境」(dreaming)架構的改進。

Grok 4.3 現已在 Vercel AI Gateway 上線,具備 2025 年 12 月知識截止日期與 1M 權杖上下文視窗。可在 AI SDK 中設定模型為 xai/grok-4.3 來使用。Gateway 提供統一 API、使用追蹤、重試、容錯、觀測性及 Bring Your Own Key 支援。
Openrouter 的隱藏模型 Hunter Alpha 和 Healer Alpha 正式確認為 MiMo V2 Pro 和 MiMo V2 Omni。Hunter Pro 提供 1M 上下文的純文字推理,Healer Omni 支援文字+圖像,上下文 262K。一款新模型即將推出,經 Github 確認。

Anthropic 正式全面開放 Claude Opus 4.6 和 Sonnet 4.6 的 100 萬 token 上下文窗口,並以標準價格計費,不再收取長上下文溢價。Opus 4.6 輸入每百萬 token 5 美元、輸出 25 美元;Sonnet 4.6 輸入 3 美元、輸出 15 美元。即使是 90 萬 token 的請求,單位 token 費用也與 9000 token 請求相同。
OpenAI 準備推出 GPT-5.4,上下文視窗超過 100 萬 tokens,超越 GPT-5.2 的 40 萬限制。它在長時間複雜任務中表現更佳,錯誤率降低,並引入「極限推理」模式以解決更深層問題。此舉追趕 Google 與 Anthropic 的大型上下文模型。

DeepSeek 從 2 月 13 日起在其網頁和 App 版本開始測試一款支援 100 萬 token 的新型長上下文模型。這引發業界對農曆新年重大發布的猜測,可能複製去年模型的爆紅成功。

GitLab 將 Anthropic 的 Claude Opus 4.6 整合至 Duo Agent Platform,提供 100 萬 token 上下文視窗及優異的代理能力,用於複雜開發工作流程。可於 GitLab.com 的所有代理及 Agentic Chat 使用,結合 DevSecOps 資料提供豐富上下文。主要優勢包括主動行動、多代理協調及適應性推理。
DeepSeek 於 2 月 11 日悄然更新模型,將上下文窗口從 128K 擴展至 1M token,同時 V4 版本傳聞四起。創辦人梁文鋒保持沉默,中國 AI 巨頭如字節跳動與阿里推出積極促銷和新模型。業界翹首期待 DeepSeek 在激烈競爭中的下一步。