
MiniMax M2.5 周調用破 3T Tokens 登頂
MiniMax M2.5 發布後登頂 OpenRouter 熱度與調用榜,周調用量達 3.07T tokens,超過 Kimi K2.5 等對手總和。它帶動 100K-1M 長文本 Agent 工作流需求。模型權重全面開源,支持本地部署。
Tag: #agent-workflows18 results

MiniMax M2.5 發布後登頂 OpenRouter 熱度與調用榜,周調用量達 3.07T tokens,超過 Kimi K2.5 等對手總和。它帶動 100K-1M 長文本 Agent 工作流需求。模型權重全面開源,支持本地部署。

AI 大模型產業已進入競爭日益殘酷的階段,效能門檻持續上升,市場空間不斷收窄。隨著 Agent 成為主流應用形式,供應商的競爭焦點已從單輪對話基準轉向端到端任務的整體性價比。
Qwen Code v0.21.6-preview.0 新增瀏覽器擴充功能就緒診斷、無頭 Goal 工作流程文件,以及更完善的 PR、Issue 與留言 URL artifact 記錄。此版本也改善 web-shell 代理、程式碼審查流程、提示快取重用、推理設定與桌面版簽署機制。
Qwen Code v0.21.5 nightly 新增瀏覽器擴充功能就緒診斷、無頭 Goal 工作流程文件,以及 PR、議題與留言 URL 的產物記錄功能。此版本也強化推理設定、程式碼審查迴圈、Web Shell 代理、桌面簽署與提示快取效能。

AWS 示範如何使用 Amazon Bedrock AgentCore Browser 建立自動化網站洞察擷取流程。此方案可監控 RSS feed、可靠地載入網頁、透過 Amazon Bedrock 擷取洞察,並將結果索引至 Amazon OpenSearch Serverless。

Moonshot AI 的 Kimi K3、Alibaba 的 Qwen3.8-Max,以及 ByteDance 的 Doubao-Seed-2.1 正採用原生多模態訓練。文章認為,直接整合至模型中的視覺能力,可能成為長時間代理任務的關鍵;DeepSeek、Zhipu 與 Tencent Hunyuan 則仍維持純文字模型。

Weaviate 推出 Agent Skills,這是一項用於建構生產就緒代理工作流程的新功能。使用者可直接在 Claude Code、Cursor 和 GitHub Copilot 等工具中使用單一提示來建立這些工作流程。這簡化了在 Weaviate 向量資料庫平台上的代理開發。

文章探討 DeepSeek V4 Flash 的出現如何讓大模型競爭轉向「智效比」,也就是相對成本與資源所能提供的智能價值。內容聚焦於 Agent 時代,實務工作者應如何挑選高智效模型。