📱較早收集於 26m

小米:請叫我 Token 價格屠夫

小米:請叫我 Token 價格屠夫
PostLinkedIn
📱閱讀原文: Ifanr (爱范儿)

💡小米激進的價格戰正在撼動 AI 基礎設施市場,快來看看您是否能藉此降低推論成本。

⚡ 30-Second TL;DR

有什麼變化

大幅降低 AI 服務的 Token 定價

為什麼重要

迫使其他 AI 供應商重新評估其定價模式,以在大眾開發者市場中保持競爭力。

下一步行動

比較小米最新的 Token 定價與您目前的 LLM 供應商,評估轉換服務是否能降低您的基礎設施成本。

誰應關注:Founders & Product Leaders

關鍵要點

  • 大幅降低 AI 服務的 Token 定價
  • 策略重心在於實現高流量、低成本的 AI 普及
  • 在價格上與現有雲端及模型供應商展開直接競爭

🧠 深度解析

Web-grounded analysis with 30 cited sources.

🔑 增強重點摘要

  • 小米MiMo-V2.5系列API的降價是永久性且全球同步的,其中輸入緩存命中價格最高降幅達99%,並簡化了計費規則,不再區分上下文窗口長度,旨在降低開發者接入門檻。
  • 小米同步優化了其「Token Plan」計費體系,在維持原有套餐價格不變的前提下,用戶可使用的Token數量提升至原來的5到8倍,並對所有有效訂閱用戶的Credits額度進行了重置。
  • 此舉將小米置於與DeepSeek、阿里巴巴、百度等中國主要AI模型供應商的直接價格競爭中,反映出中國AI模型市場日益激烈的價格戰。
  • 本次價格調整的核心驅動力來自小米底層推理系統的持續優化,包括基於SGLang HiCache完整支援SWA(Sliding Window Attention)技術,顯著降低了KV Cache在多層儲存之間的數據搬運量,並提升了叢集吞吐能力。
  • 小米的AI戰略與其「人車家全生態」深度整合,旨在透過AI重構並更自然地連接其廣泛的硬體產品線(手機、汽車、智能家居設備),以實現全面的智能化生態系統。
📊 競品分析▸ Show
特性/供應商小米 MiMo-V2.5 Pro小米 MiMo-V2.5DeepSeek V4 ProOpenAI (參考)
模型名稱MiMo-V2.5 ProMiMo-V2.5DeepSeek V4 ProGPT-4o (參考)
輸入價格 (緩存命中)0.025 元/百萬tokens (最高降99%)0.020 元/百萬tokens (最高降98%)0.025 元/百萬tokens約 21 元/百萬tokens (3美元)
輸出價格6 元/百萬tokens2 元/百萬tokens6 元/百萬tokens較高
基準測試表現在Artificial Analysis綜合智能指數與Agent指數中躋身全球開源模型並列第一 (Xiaomi MiMo-V2.5-Pro);MiMo-V2-Pro在OpenRouter調用量周榜冠軍,Artificial Analysis大模型智能指數全球第八、國內第二-在Agent能力、世界知識和推理性能上實現國內與開源領域領先業界領先
計費規則不再區分上下文窗口長度,Token Plan用量提升5-8倍不再區分上下文窗口長度,Token Plan用量提升5-8倍永久降價,取消臨時折扣-

🛠️ 技術深入

  • MiLM-6B: 小米開發的大規模預訓練語言模型,參數規模達64億,在C-Eval和CMMLU評測中取得同尺寸最佳效果。
  • MiLM2 (第二代大模型): 擴充了模型參數矩陣,實現雲邊端結合,參數規模從0.3B到30B不等。相較於第一代模型,在10大能力維度上平均提升超過45%,並支援最長200k的上下文窗口。
  • MiLM2 MoE模型: 引入了Mixture of Experts (MoE) 結構,如MiLM2-0.7B×8和MiLM2-2B×8,旨在提高效率和解碼速度,例如MiLM2-2B×8的解碼速度比MiLM2-6B提升50%,同時保持性能。
  • MiMo-V2.5系列: 包含MiMo-V2.5-Pro(高性能複雜推理)、MiMo-V2.5(輕量化通用需求)和MiMo-V2.5-TTS(語音合成,限時免費)等版本,是小米面向商用普惠市場的主力產品。
  • 底層推理系統優化: 採用SGLang HiCache完整支援SWA(Sliding Window Attention)技術,將KV Cache在GPU顯存、CPU記憶體與SSD多層儲存之間的數據搬運量降至約七分之一,同時可快取Token數量提升近五倍。此外,還透過專家並行方案和輸入長度分桶策略提升叢集吞吐能力。
  • MiMo-V2-Pro: 旗艦基座大模型,總參數量超過1T(激活參數42B),支援1M超長上下文長度,底層架構繼承了混合注意力機制,並將混合比例提升至7:1。
  • MiMo-V2-Omni: 全模態Agent模型,整合了圖像、視頻及音頻的多模態理解能力與強大的智能體能力。
  • MiMo-V2-Flash: 開源模型,參數規模309B,採用5:1混合注意力機制(SWA滑動窗口與全局注意力協同工作)、可學習的注意力匯聚偏置、MTP多層Token預測(實現最高2.6倍推理加速)和MOPD在線策略蒸餾等技術。

🔮 前景展望AI analysis grounded in cited sources

小米將加速其「人車家全生態」戰略的智能化進程。
降低Token價格和優化模型服務將吸引更多開發者和應用接入,進一步深化AI在手機、汽車和智能家居產品中的整合與應用。
中國AI模型市場的價格戰將進一步加劇,促使更多廠商降低服務成本。
小米作為主要參與者之一,其大幅降價策略將迫使其他競爭對手跟進,以維持市場競爭力並吸引開發者。
低成本AI服務將推動AI應用的大規模普及和創新。
降低開發者使用AI模型的門檻,將激發更多創新應用場景的出現,特別是在高頻Agent和批量推理任務中。

時間線

2016-00
小米成立AI實驗室,開始探索人工智能領域。
2017-07
小米發布首款AI智能音箱「小愛同學」。
2018-11
小米發布面向智能家居的人工智能開放平台,並將AI+IoT確立為核心戰略。
2019-01
小米啟動「手機+AIoT」雙引擎戰略,並宣布未來5年將在AIoT領域投入至少100億元。
2023-08
小米自研大模型MiLM首次亮相C-Eval、CMMLU榜單,參數規模達64億。
2024-05
小米AI大模型MiLM正式通過備案。
2024-11
小米發布第二代大模型MiLM2,實現雲邊端結合,能力平均提升超45%。
2025-03
小米發布旗艦基座大模型MiMo-V2-Pro、全模態Agent模型MiMo-V2-Omni及語音合成模型MiMo-V2-TTS。
2026-01
小米MiMo人工智慧大模型API平台開放充值並公佈全球定價,標誌其AI服務商業化落地。
2026-05
小米MiMo-V2.5系列大模型API永久降價,最高降幅達99%。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Ifanr (爱范儿)