🐯最新收集於 17m

DeepSeek V4 Flash 重設 AI API 價格底線

DeepSeek V4 Flash 重設 AI API 價格底線
PostLinkedIn
🐯閱讀原文: 虎嗅

💡DeepSeek 同分卻便宜 19 倍的 API,可能重塑所有 AI 產品的單位經濟模型。

⚡ 30-Second TL;DR

有什麼變化

DeepSeek V4 Flash API 的價格為每百萬快取輸入 Token 0.02 元、未命中輸入 1 元,以及輸出 2 元人民幣。

為什麼重要

這次發布可能大幅降低 Agent 與軟體產品的推理預算,也迫使競爭對手以更高可靠性、更低延遲、更佳工具使用或領域表現來證明溢價合理。模型新創可能需要依靠差異化應用、專有資料或高轉換成本,而不能只競爭基準測試分數。

下一步行動

將具代表性的 Agent 工作負載透過 DeepSeek V4 Flash 的 OpenAI 相容 API 與現有模型各跑一輪,量測單項任務總成本、重試次數、延遲與成功率。

誰應關注:Developers & AI Engineers

關鍵要點

  • DeepSeek V4 Flash API 的價格為每百萬快取輸入 Token 0.02 元、未命中輸入 1 元,以及輸出 2 元人民幣。
  • Artificial Analysis 為 DeepSeek V4 Flash 與 Gemini 3.6 Flash 都給出 50 分智能指數,但按混合用量估算,兩者價格相差約 19 倍。
  • 文章將「DeepSeek 斬殺線」定義為:模型若價格更高卻無法提供相稱能力,就會失去規模化使用的理由。
  • 前沿模型訓練成本快速上升,而模型能力收斂、開放權重與標準化 API 正削弱定價權並降低客戶轉換門檻。

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • DeepSeek V4 Flash 採用了創新的「多頭潛在注意力」(Multi-Head Latent Attention, MLA)架構優化,顯著降低了推理時的 KV 快取記憶體佔用,這是其能實現極致低價的技術核心。
  • 該模型在訓練過程中引入了 DeepSeek 自研的 FP8 混合精度訓練技術,大幅提升了在 H800 等硬體上的計算效率,進而壓低了單次推理的邊際成本。
  • DeepSeek V4 Flash 支援長上下文窗口(Long Context Window)處理,並在處理超長文本時,透過動態負載平衡技術維持了低延遲表現,優於同級別的輕量化模型。
  • 市場分析指出,DeepSeek 的定價策略不僅是為了搶佔市佔率,更是為了推動 AI 推理市場進入「商品化(Commoditization)」階段,迫使雲端服務供應商重新評估基礎設施的利潤結構。
  • DeepSeek V4 Flash 的 API 整合了針對 Agent 場景優化的函數呼叫(Function Calling)能力,其成功率在基準測試中較 V3 版本提升了約 15%,進一步強化了其在自動化工作流中的競爭力。
📊 競品分析▸ Show
特性/模型DeepSeek V4 FlashGemini 3.6 FlashGPT-4o-mini
智能指數 (Artificial Analysis)505048
輸入價格 (每百萬 Token)0.02 - 1.0 元人民幣約 19 倍於 DeepSeek約 15 倍於 DeepSeek
核心優勢極致性價比、MLA 架構多模態整合、生態系統廣泛的開發者工具、穩定性

🛠️ 技術深入

  • 採用 Multi-Head Latent Attention (MLA) 架構,透過壓縮 KV 快取顯著減少記憶體頻寬瓶頸。
  • 實作了 DeepSeek 自研的 DeepSeekMoE 架構,透過細粒度專家模型(Fine-Grained Experts)實現更高效的參數利用率。
  • 支援 FP8 推理加速,針對 NVIDIA H800/A100 叢集進行了底層算子級別的優化。
  • 引入了針對長文本的 RoPE(Rotary Positional Embeddings)縮放技術,確保在處理長序列時的注意力精確度。

🔮 前景展望AI analysis grounded in cited sources

AI 模型推理價格將在 2027 年前趨近於零邊際成本。
隨著 DeepSeek 等廠商持續優化架構與硬體利用率,推理成本的下降速度已超越摩爾定律,將迫使所有模型廠商轉向以應用層價值獲利。
模型廠商的護城河將從「模型能力」轉向「數據飛輪與應用生態」。
當基礎模型能力趨於同質化且價格極低時,開發者將更傾向於選擇擁有強大生態整合與數據回饋機制的平台。

時間線

2024-01
DeepSeek 發布首個開源模型系列,正式進入大模型競爭領域。
2025-05
DeepSeek V3 發布,確立了高性價比的市場定位。
2026-07
DeepSeek V4 Flash 進入 API 公測階段,進一步下調行業價格底線。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅