
Refiant AI 發布具備 1,000 萬 token 記憶能力的 Protea 模型
南非新創公司 Refiant AI 正式發布了名為 Protea 的 AI 模型,該模型具備高達 1,000 萬 token 的記憶能力。此舉發生在該公司於四月完成 500 萬美元融資之後。
Tag: #long-context85 results

南非新創公司 Refiant AI 正式發布了名為 Protea 的 AI 模型,該模型具備高達 1,000 萬 token 的記憶能力。此舉發生在該公司於四月完成 500 萬美元融資之後。

Narrative World Model (NWM) 引入了基於敘事學的時間狀態圖,協助 AI 追蹤長篇小說中複雜的故事情節。在多跳敘事推理任務中,其表現顯著優於現有的代理記憶框架(如 Graphiti/Zep)。

Akashic 是一項新的 LLM 推論服務,利用 MemAttention 將數據組織成有界區塊,藉此優化長文本管理。它透過減少檢索碎片化並最小化 I/O 開銷來提高效率,無需重複重寫完整的互動歷史記錄。

Baidu 推出了 Unlimited-OCR,這是一項旨在高效處理長文件的技術。它利用 Constant KV Cache 機制,在文件處理任務中實現了業界領先的效能。

AdaCoM 是一個新框架,透過訓練外部 LLM 來管理凍結代理(frozen agents)的上下文,進而提升網頁搜尋等長程任務的效能。它能透過修剪過時資訊並保留任務關鍵限制來優化上下文。

Vercel 已將具備 100 萬 token 上下文窗口與原生多模態能力的 MiniMax M3 模型整合至 AI Gateway。開發者現在可以透過統一的 API 使用其強大的代理(agentic)功能與多模態輸入。
Together AI 探討伺服 DeepSeek-V4,將百萬 token 上下文視為推理系統難題。他們詳述在 NVIDIA HGX B200 上的優化,包括壓縮 KV 佈局、前綴快取、核心成熟度,以及長上下文工作負載的端點配置。

xAI 推出 Grok 4.3,API 價格減半,並發布快速語音克隆套件。具備永久推理與 1M 權杖脈絡,但基準落後頂尖模型。可透過 xAI API 及 OpenRouter 使用。
後續最佳化讓 Qwen3.6-27B 在單張 RTX 3090 上達 ~218K 上下文、50-66 TPS。經 PN12 修補後,工具呼叫穩定支援 25K 權重元輸出。也支援 198K 視覺上下文。
OpenClaw 最新版本 2026.4.24 整合 DeepSeek-V4,將 V4 Flash 設為預設大模型,並將 V4 Pro 加入模型庫。DeepSeek-V4 預覽版於 4 月 24 日上線並開源,採用 MoE 架構並支援 100 萬 token 上下文。此舉提升高參數開源模型的可用性。