📱Ifanr (爱范儿)•較早收集於 26m
小米:請叫我 Token 價格屠夫

💡小米激進的價格戰正在撼動 AI 基礎設施市場,快來看看您是否能藉此降低推論成本。
⚡ 30-Second TL;DR
有什麼變化
大幅降低 AI 服務的 Token 定價
為什麼重要
迫使其他 AI 供應商重新評估其定價模式,以在大眾開發者市場中保持競爭力。
下一步行動
比較小米最新的 Token 定價與您目前的 LLM 供應商,評估轉換服務是否能降低您的基礎設施成本。
誰應關注:Founders & Product Leaders
關鍵要點
- •大幅降低 AI 服務的 Token 定價
- •策略重心在於實現高流量、低成本的 AI 普及
- •在價格上與現有雲端及模型供應商展開直接競爭
🧠 深度解析
Web-grounded analysis with 30 cited sources.
🔑 增強重點摘要
- •小米MiMo-V2.5系列API的降價是永久性且全球同步的,其中輸入緩存命中價格最高降幅達99%,並簡化了計費規則,不再區分上下文窗口長度,旨在降低開發者接入門檻。
- •小米同步優化了其「Token Plan」計費體系,在維持原有套餐價格不變的前提下,用戶可使用的Token數量提升至原來的5到8倍,並對所有有效訂閱用戶的Credits額度進行了重置。
- •此舉將小米置於與DeepSeek、阿里巴巴、百度等中國主要AI模型供應商的直接價格競爭中,反映出中國AI模型市場日益激烈的價格戰。
- •本次價格調整的核心驅動力來自小米底層推理系統的持續優化,包括基於SGLang HiCache完整支援SWA(Sliding Window Attention)技術,顯著降低了KV Cache在多層儲存之間的數據搬運量,並提升了叢集吞吐能力。
- •小米的AI戰略與其「人車家全生態」深度整合,旨在透過AI重構並更自然地連接其廣泛的硬體產品線(手機、汽車、智能家居設備),以實現全面的智能化生態系統。
📊 競品分析▸ Show
| 特性/供應商 | 小米 MiMo-V2.5 Pro | 小米 MiMo-V2.5 | DeepSeek V4 Pro | OpenAI (參考) |
|---|---|---|---|---|
| 模型名稱 | MiMo-V2.5 Pro | MiMo-V2.5 | DeepSeek V4 Pro | GPT-4o (參考) |
| 輸入價格 (緩存命中) | 0.025 元/百萬tokens (最高降99%) | 0.020 元/百萬tokens (最高降98%) | 0.025 元/百萬tokens | 約 21 元/百萬tokens (3美元) |
| 輸出價格 | 6 元/百萬tokens | 2 元/百萬tokens | 6 元/百萬tokens | 較高 |
| 基準測試表現 | 在Artificial Analysis綜合智能指數與Agent指數中躋身全球開源模型並列第一 (Xiaomi MiMo-V2.5-Pro);MiMo-V2-Pro在OpenRouter調用量周榜冠軍,Artificial Analysis大模型智能指數全球第八、國內第二 | - | 在Agent能力、世界知識和推理性能上實現國內與開源領域領先 | 業界領先 |
| 計費規則 | 不再區分上下文窗口長度,Token Plan用量提升5-8倍 | 不再區分上下文窗口長度,Token Plan用量提升5-8倍 | 永久降價,取消臨時折扣 | - |
🛠️ 技術深入
- MiLM-6B: 小米開發的大規模預訓練語言模型,參數規模達64億,在C-Eval和CMMLU評測中取得同尺寸最佳效果。
- MiLM2 (第二代大模型): 擴充了模型參數矩陣,實現雲邊端結合,參數規模從0.3B到30B不等。相較於第一代模型,在10大能力維度上平均提升超過45%,並支援最長200k的上下文窗口。
- MiLM2 MoE模型: 引入了Mixture of Experts (MoE) 結構,如MiLM2-0.7B×8和MiLM2-2B×8,旨在提高效率和解碼速度,例如MiLM2-2B×8的解碼速度比MiLM2-6B提升50%,同時保持性能。
- MiMo-V2.5系列: 包含MiMo-V2.5-Pro(高性能複雜推理)、MiMo-V2.5(輕量化通用需求)和MiMo-V2.5-TTS(語音合成,限時免費)等版本,是小米面向商用普惠市場的主力產品。
- 底層推理系統優化: 採用SGLang HiCache完整支援SWA(Sliding Window Attention)技術,將KV Cache在GPU顯存、CPU記憶體與SSD多層儲存之間的數據搬運量降至約七分之一,同時可快取Token數量提升近五倍。此外,還透過專家並行方案和輸入長度分桶策略提升叢集吞吐能力。
- MiMo-V2-Pro: 旗艦基座大模型,總參數量超過1T(激活參數42B),支援1M超長上下文長度,底層架構繼承了混合注意力機制,並將混合比例提升至7:1。
- MiMo-V2-Omni: 全模態Agent模型,整合了圖像、視頻及音頻的多模態理解能力與強大的智能體能力。
- MiMo-V2-Flash: 開源模型,參數規模309B,採用5:1混合注意力機制(SWA滑動窗口與全局注意力協同工作)、可學習的注意力匯聚偏置、MTP多層Token預測(實現最高2.6倍推理加速)和MOPD在線策略蒸餾等技術。
🔮 前景展望AI analysis grounded in cited sources
小米將加速其「人車家全生態」戰略的智能化進程。
降低Token價格和優化模型服務將吸引更多開發者和應用接入,進一步深化AI在手機、汽車和智能家居產品中的整合與應用。
中國AI模型市場的價格戰將進一步加劇,促使更多廠商降低服務成本。
小米作為主要參與者之一,其大幅降價策略將迫使其他競爭對手跟進,以維持市場競爭力並吸引開發者。
低成本AI服務將推動AI應用的大規模普及和創新。
降低開發者使用AI模型的門檻,將激發更多創新應用場景的出現,特別是在高頻Agent和批量推理任務中。
⏳ 時間線
2016-00
小米成立AI實驗室,開始探索人工智能領域。
2017-07
小米發布首款AI智能音箱「小愛同學」。
2018-11
小米發布面向智能家居的人工智能開放平台,並將AI+IoT確立為核心戰略。
2019-01
小米啟動「手機+AIoT」雙引擎戰略,並宣布未來5年將在AIoT領域投入至少100億元。
2023-08
小米自研大模型MiLM首次亮相C-Eval、CMMLU榜單,參數規模達64億。
2024-05
小米AI大模型MiLM正式通過備案。
2024-11
小米發布第二代大模型MiLM2,實現雲邊端結合,能力平均提升超45%。
2025-03
小米發布旗艦基座大模型MiMo-V2-Pro、全模態Agent模型MiMo-V2-Omni及語音合成模型MiMo-V2-TTS。
2026-01
小米MiMo人工智慧大模型API平台開放充值並公佈全球定價,標誌其AI服務商業化落地。
2026-05
小米MiMo-V2.5系列大模型API永久降價,最高降幅達99%。
📎 來源 (30)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- sina.com.cn
- ettoday.net
- etnet.com.hk
- 36kr.com
- 36kr.com
- cnyes.com
- 36kr.com
- biggo.com.tw
- binance.com
- 9466.com
- ebrun.com
- xinhuanet.com
- cb.com.cn
- dfcfw.com
- cnyes.com
- aitntnews.com
- hk01.com
- c114.com.cn
- github.com
- aibetas.com.cn
- sina.com.cn
- tencent.com
- xiaomimimo.com
- wallstreetcn.com
- qbitai.com
- bnext.com.tw
- geekbang.org
- wicinternet.org
- zqrb.cn
- biggo.com.tw
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Ifanr (爱范儿) ↗
