🇭🇰較早收集於 30m

小米推出排名第一的開源代理 AI 模型

小米推出排名第一的開源代理 AI 模型
PostLinkedIn
🇭🇰閱讀原文: SCMP Technology

💡小米新款開源模型在代理基準測試中奪冠,標誌著硬體整合 AI 的重大轉變。

⚡ 30-Second TL;DR

有什麼變化

MiMo-V2.5-Pro 針對硬體環境中的代理工作流程進行了優化。

為什麼重要

此舉顯示小米意圖透過為其硬體生態系統建立專有的代理導向 AI 技術堆疊,直接與全球科技巨頭競爭。這凸顯了硬體製造商優先發展裝置端代理智慧的趨勢。

下一步行動

在 Artificial Analysis 上評估 MiMo-V2.5-Pro 的基準測試,確認其代理效能是否符合您的特定自動化應用需求。

誰應關注:Developers & AI Engineers

關鍵要點

  • MiMo-V2.5-Pro 針對硬體環境中的代理工作流程進行了優化。
  • 被 Artificial Analysis 評為全球代理任務能力最強的開源模型。
  • 是小米將 AI 整合至智慧型手機與電動車生態系統的戰略核心。

🧠 深度解析

Web-grounded analysis with 22 cited sources.

🔑 增強重點摘要

  • 小米的MiMo-V2.5-Pro及MiMo-V2.5模型已根據MIT許可證全面開源,支援商業用途及二次訓練,旨在降低開發者使用門檻並鼓勵創新應用。
  • 小米同步推出「MiMo Orbit計劃」,包含「百萬億Token創造者激勵計劃」在30天內提供100萬億免費Token,以及「Agent生態共建計劃」為Agent框架團隊提供專項支持,以迅速擴大開發者生態系統。
  • MiMo-V2.5系列模型支援100萬上下文窗口,並在開源首日即實現與亞馬遜雲科技(AWS)、阿里平頭哥、AMD、百度崑崙芯等多家主流晶片廠商,以及SGLang、vLLM等主流推理框架的「Day 0」深度適配,確保開發者能即時部署與開發。
  • MiMo-V2.5-Pro在訓練中特別優化了「腳手架意識」(harness awareness),使其能夠在Claude Code或OpenCode等自主智能體框架中有效管理自身記憶和上下文,從而在數千次連續工具調用中保持邏輯一致性。
  • 該模型在複雜軟體工程任務上表現卓越,例如在北大《編譯原理》課程項目中,MiMo-V2.5-Pro僅用4.3小時、672次工具調用,就以Rust從零實現了完整的SysY編譯器,並在隱藏測試集上取得滿分。
📊 競品分析▸ Show
特性/模型小米 MiMo-V2.5-Pro (開源)Kimi K2.6 (閉源)DeepSeek-V4 (開源/閉源)Claude Opus 4.6 (閉源)GPT-5.4 (閉源)
代理能力排名 (Artificial Analysis)開源模型並列第一高排名,但Token效率較低高排名頂尖頂尖
上下文窗口100萬 Token較長,但Token效率低於MiMo-V2.5-Pro較長較長較長
Token效率 (ClawEval基準)比Kimi K2.6節省42% Token較高消耗DeepSeek V4 Flash約2億輸出TokenClaude Sonnet 4.6約2億輸出TokenGPT-5.4 mini約2億輸出Token
SWE-bench Pro分數57.2%----
訓練Token量27兆 Token----
許可協議MIT協議 (開源)專有部分開源/專有專有專有

🛠️ 技術深入

  • 上下文窗口:MiMo-V2.5-Pro支援高達100萬Token的上下文處理能力。
  • 訓練數據與精度:模型使用27兆Token進行訓練,並採用FP8混合精度和原生32K序列長度。
  • 架構優化:MiMo-V2.5-Pro採用MoE(混合專家)架構,並配備三個使用密集FFN(前饋網路)的輕量級MTP(多Token預測)模組,這可將推理階段的輸出速度提升約3倍,並加速強化學習訓練中的rollout。
  • 推理優先理念:小米MiMo團隊的核心技術路線是「推理優先」(Reasoning-first),透過在預訓練階段系統性地提高訓練資料中的推理模式密度,並結合MTP、強化學習(RL)及多教師線上策略蒸餾(MOPD)等後訓練範式,增強模型在數學推理、代碼生成和工具調用方面的能力。
  • 智能體優化:模型訓練重點轉向「腳手架意識」(harness awareness),使其能夠在自主智能體腳手架中主動管理記憶和上下文,以在數千次連續工具調用中保持一致性。
  • 多模態能力:MiMo-V2.5系列包含MiMo-V2.5全模態版本,具備多模態理解能力,支援圖像、音訊、影片等高級多媒體功能。
  • 基準表現:在SWE-bench Pro基準測試中,MiMo-V2.5-Pro取得了57.2%的分數。

🔮 前景展望AI analysis grounded in cited sources

小米將透過MiMo-V2.5-Pro加速其「人車家全生態」戰略的AI整合與商業化。
MiMo-V2.5系列將深化與HyperOS系統、小米SU7车载座舱、米家IoT设备及WPS靈犀辦公場景的整合,並透過Token計劃和訂閱服務探索AI變現,預計將提升產品定價並針對高價值場景提供訂閱服務。
MiMo-V2.5-Pro的開源策略將顯著推動全球開源代理AI生態系統的發展。
小米透過「MiMo Orbit計劃」提供大量免費Token和Agent生態共建支持,並實現了與多個主流晶片廠商和推理框架的「Day 0」適配,降低了開發者使用和部署頂級Agent模型的門檻。
MiMo-V2.5-Pro在複雜軟體工程和長程任務上的卓越表現將加速AI在自動化軟體開發領域的應用。
該模型在北大《編譯原理》課程項目中僅用4.3小時、672次工具調用即用Rust從零實現完整SysY編譯器並取得滿分,顯示其在自主編程和長程任務規劃上的強大能力。

時間線

2018-11
小米AIoT開發者大會,確立AI+IoT為核心戰略。
2020-08
小米核心戰略升級為「手機X AIoT」,強調乘法效應,將AIoT生態作為手機業務的催化助燃劑。
2023
小米大模型Core團隊成立,由小米創始人兼CEO雷軍推動。
2025-04
小米發布首個推理大模型MiMo-7B並開源,專為推理而生,在數學推理和程式碼競賽中表現出色。
2025-12
小米MiMo-V2-Flash開源,採用MoE架構,並由前DeepSeek核心成員羅福莉首次亮相並擔任MiMo大模型負責人。
2026-03
小米發布MiMo-V2-Pro、MiMo-V2-Omni及MiMo-V2-TTS三款大模型,其中MiMo-V2-Pro支援最長100萬Token的上下文窗口。
2026-04
小米發布MiMo-V2.5系列(包含MiMo-V2.5-Pro和MiMo-V2.5),並於4月28日全面開源,MiMo-V2.5-Pro在Artificial Analysis榜單中位列全球開源大模型第一。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: SCMP Technology