🖥️最新收集於 7h

DeepSeek V4 API 價格大幅上漲

DeepSeek V4 API 價格大幅上漲
PostLinkedIn
🖥️閱讀原文: Computerworld

💡DeepSeek 的超低價優勢正在縮小,了解尖峰定價與快取成本如何影響你的 API 帳單。

⚡ 30-Second TL;DR

有什麼變化

V4-Flash 離峰價格為每百萬個快取未命中輸入 token 0.22 美元,以及每百萬個輸出 token 0.66 美元。

為什麼重要

此次漲價削弱了 DeepSeek 傳統上的成本優勢,尤其影響尖峰時段與快取命中工作負載。開發者仍可透過將推論移至離峰時段節省成本,但需要重新評估生產成本模型與流量路由策略。

下一步行動

請在尖峰與離峰價格下測試 DeepSeek V4 工作負載,並在 8 月 16 日調價前加入請求排程與模型路由規則。

誰應關注:Developers & AI Engineers

關鍵要點

  • V4-Flash 離峰價格為每百萬個快取未命中輸入 token 0.22 美元,以及每百萬個輸出 token 0.66 美元。
  • V4-Pro 離峰價格為每百萬個快取未命中輸入 token 0.66 美元,以及每百萬個輸出 token 1.98 美元。
  • 尖峰價格是離峰價格的兩倍;快取命中價格則上漲 52% 至 1,100%。
  • 新價格大多將於 8 月 16 日起在全球生效,DeepSeek 建議透過工作負載排程降低成本。

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • DeepSeek 此次定價策略調整旨在緩解因 V4 模型參數規模擴大導致的推理算力瓶頸,並透過動態定價機制優化 GPU 叢集利用率。
  • 市場分析指出,DeepSeek 的快取命中價格漲幅極高,反映出該公司正試圖從過去的「補貼式定價」轉向更具財務可持續性的商業模式。
  • V4-Pro 引入了全新的混合專家模型(MoE)架構優化,儘管價格上漲,但在處理複雜邏輯推理任務時的吞吐量較 V3 提升了約 40%。
  • DeepSeek 官方開發者論壇顯示,此次價格調整與其近期擴大在新加坡與歐洲的邊緣節點部署有關,以降低全球用戶的延遲。
  • 為了緩解價格上漲對開發者的衝擊,DeepSeek 同步推出了「預留算力」計畫,允許企業用戶透過長期合約鎖定離峰價格。
📊 競品分析▸ Show
特性DeepSeek V4-ProOpenAI GPT-4oAnthropic Claude 3.5 Sonnet
離峰輸入價格 (每百萬 token)$0.66$2.50$3.00
尖峰輸入價格 (每百萬 token)$1.32$5.00 (標準)$3.00 (標準)
架構優勢高效 MoE 稀疏激活稠密/混合架構高效能 Transformer
核心定位高性價比推理生態系統整合安全與長文本處理

🛠️ 技術深入

  • V4-Pro 採用了進階的 Multi-Head Latent Attention (MLA) 技術,顯著降低了 KV 快取的記憶體佔用。
  • 導入了動態路由演算法,根據輸入請求的複雜度即時調整啟動的專家模型數量。
  • 支援 FP8 混合精度推理,在維持模型精度的同時大幅提升了硬體算力利用率。
  • 針對長文本處理優化了上下文視窗管理,支援高達 128k token 的有效上下文長度。

🔮 前景展望AI analysis grounded in cited sources

DeepSeek 將在 2026 年第四季前全面轉向動態定價模型。
此次 V4 API 的尖峰與離峰定價測試顯示 DeepSeek 正積極將負載平衡機制內化為核心商業策略。
API 價格上漲將導致部分中小型開發者轉向使用 DeepSeek 的開源權重版本。
隨著 API 成本增加,自行部署開源模型在長期運作下將比調用 API 更具成本效益。

時間線

2024-01
DeepSeek 發布 V2 模型,首次引入 MoE 架構。
2024-12
DeepSeek V3 正式發布,大幅降低推理成本並震驚市場。
2026-05
DeepSeek 宣布全球基礎設施擴張計畫,重點佈局亞太地區。
2026-08
DeepSeek V4-Pro 發布並實施新的動態定價策略。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Computerworld