來源較早收集於 1m

企業 AI 推理成本創 2026 年新低

閱讀原文: SCMP Technology
#inference-pricing#token-economics#chinese-models#price-war

推理價格快速下跌,了解 DeepSeek 與價格戰如何重塑你的 AI 服務預算。

30 秒速覽

有什麼變化

平均推理價格降至每百萬 token 1.16 至 1.18 美元。

為什麼重要

更低的推理成本有助改善高流量 AI 應用的經濟效益,也讓企業更容易進行模型實驗。不過,模型供應商可能面臨利潤壓力,企業團隊也需要在價格之外評估模型品質、可靠性與合規性。

下一步行動

使用具代表性的工作負載比較 DeepSeek 與目前的生產模型,重新計算每百萬 token 成本及經品質調整後的服務成本。

誰應關注:Enterprise & Security Teams

關鍵要點

  • •平均推理價格降至每百萬 token 1.16 至 1.18 美元。
  • •8 月 6 日至 8 日的價格區間是 2026 年迄今最低水平。
  • •全球 AI 供應商正陷入日益激烈的價格戰。
  • •包括 DeepSeek 在內的低成本中國開源模型,正加大價格壓力。

深度解析

本篇為 AI 生成分析,非原文內容。

增強重點摘要

  • •Jefferies 分析指出,推理成本的下降不僅源於模型效率提升,還與雲端服務供應商(CSP)為爭奪企業客戶而進行的基礎設施折舊攤提策略有關。
  • •DeepSeek 的定價策略迫使美國主流模型供應商(如 OpenAI 與 Anthropic)在企業級 API 服務中引入更多階梯式折扣,以維持市場佔有率。
  • •市場數據顯示,企業對推理成本的敏感度在 2026 年第三季顯著提高,促使開發者從大型通用模型轉向針對特定任務優化的中小型模型(SLM)。
  • •硬體利用率的優化,特別是針對 NVIDIA Blackwell 架構及後續晶片的推理加速技術,是支撐本次價格戰的技術底層。
  • •除了價格競爭,企業客戶目前更傾向於選擇支援多模型架構(Multi-model routing)的平台,以在成本與效能之間實現動態平衡。

競品分析

DeepSeek V3/R1
推理價格 (每百萬 Token)
$0.10 - $0.50 (估算)
主要優勢
極致成本效益
適用場景
高併發、成本敏感型任務
GPT-4o (企業版)
推理價格 (每百萬 Token)
$1.20 - $2.50
主要優勢
生態系統整合、多模態能力
適用場景
複雜邏輯推理、企業自動化
Claude 3.5 Sonnet
推理價格 (每百萬 Token)
$1.50 - $3.00
主要優勢
程式碼編寫、長文本處理
適用場景
軟體開發、法律文件分析

技術深入

  • 混合專家模型(MoE)架構的廣泛應用,使得推理時僅需激活模型參數的一小部分,顯著降低了單次請求的計算資源消耗。
  • 推理加速技術(如投機採樣 Speculative Decoding)被廣泛部署,透過小型模型預測輸出並由大型模型驗證,大幅提升了吞吐量。
  • 針對 FP8 與 INT4 量化技術的硬體支援成熟,在維持模型精確度的同時,減少了記憶體頻寬需求。
  • 雲端推理服務開始採用無伺服器(Serverless)架構,透過更細緻的資源排程與冷啟動優化,降低了閒置成本。

前景展望基於引用來源的 AI 分析

2026 年底前,企業級推理價格將跌破每百萬 token 1.00 美元大關。
隨著模型蒸餾技術的普及與硬體利用率的進一步提升,邊際成本仍有顯著下降空間。
AI 推理市場將從「模型為王」轉向「推理基礎設施為王」。
當模型效能趨於同質化,企業將更依賴能提供最低延遲與最低成本的推理託管平台。

時間線

2025-01
DeepSeek 發布開源模型,以極低推理成本震驚市場。
2025-09
主流雲端供應商開始大規模調降 API 推理價格以應對競爭。
2026-05
Jefferies 報告指出企業 AI 採用率因成本下降而出現顯著增長。
2026-08
企業 AI 推理價格創下 2026 年新低,達到每百萬 token 1.16 美元。

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: SCMP Technology ↗

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。