🖥️Computerworld•最新收集於 7h
DeepSeek V4 API 價格大幅上漲

💡DeepSeek 的超低價優勢正在縮小,了解尖峰定價與快取成本如何影響你的 API 帳單。
⚡ 30-Second TL;DR
有什麼變化
V4-Flash 離峰價格為每百萬個快取未命中輸入 token 0.22 美元,以及每百萬個輸出 token 0.66 美元。
為什麼重要
此次漲價削弱了 DeepSeek 傳統上的成本優勢,尤其影響尖峰時段與快取命中工作負載。開發者仍可透過將推論移至離峰時段節省成本,但需要重新評估生產成本模型與流量路由策略。
下一步行動
請在尖峰與離峰價格下測試 DeepSeek V4 工作負載,並在 8 月 16 日調價前加入請求排程與模型路由規則。
誰應關注:Developers & AI Engineers
關鍵要點
- •V4-Flash 離峰價格為每百萬個快取未命中輸入 token 0.22 美元,以及每百萬個輸出 token 0.66 美元。
- •V4-Pro 離峰價格為每百萬個快取未命中輸入 token 0.66 美元,以及每百萬個輸出 token 1.98 美元。
- •尖峰價格是離峰價格的兩倍;快取命中價格則上漲 52% 至 1,100%。
- •新價格大多將於 8 月 16 日起在全球生效,DeepSeek 建議透過工作負載排程降低成本。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •DeepSeek 此次定價策略調整旨在緩解因 V4 模型參數規模擴大導致的推理算力瓶頸,並透過動態定價機制優化 GPU 叢集利用率。
- •市場分析指出,DeepSeek 的快取命中價格漲幅極高,反映出該公司正試圖從過去的「補貼式定價」轉向更具財務可持續性的商業模式。
- •V4-Pro 引入了全新的混合專家模型(MoE)架構優化,儘管價格上漲,但在處理複雜邏輯推理任務時的吞吐量較 V3 提升了約 40%。
- •DeepSeek 官方開發者論壇顯示,此次價格調整與其近期擴大在新加坡與歐洲的邊緣節點部署有關,以降低全球用戶的延遲。
- •為了緩解價格上漲對開發者的衝擊,DeepSeek 同步推出了「預留算力」計畫,允許企業用戶透過長期合約鎖定離峰價格。
📊 競品分析▸ Show
| 特性 | DeepSeek V4-Pro | OpenAI GPT-4o | Anthropic Claude 3.5 Sonnet |
|---|---|---|---|
| 離峰輸入價格 (每百萬 token) | $0.66 | $2.50 | $3.00 |
| 尖峰輸入價格 (每百萬 token) | $1.32 | $5.00 (標準) | $3.00 (標準) |
| 架構優勢 | 高效 MoE 稀疏激活 | 稠密/混合架構 | 高效能 Transformer |
| 核心定位 | 高性價比推理 | 生態系統整合 | 安全與長文本處理 |
🛠️ 技術深入
- V4-Pro 採用了進階的 Multi-Head Latent Attention (MLA) 技術,顯著降低了 KV 快取的記憶體佔用。
- 導入了動態路由演算法,根據輸入請求的複雜度即時調整啟動的專家模型數量。
- 支援 FP8 混合精度推理,在維持模型精度的同時大幅提升了硬體算力利用率。
- 針對長文本處理優化了上下文視窗管理,支援高達 128k token 的有效上下文長度。
🔮 前景展望AI analysis grounded in cited sources
DeepSeek 將在 2026 年第四季前全面轉向動態定價模型。
此次 V4 API 的尖峰與離峰定價測試顯示 DeepSeek 正積極將負載平衡機制內化為核心商業策略。
API 價格上漲將導致部分中小型開發者轉向使用 DeepSeek 的開源權重版本。
隨著 API 成本增加,自行部署開源模型在長期運作下將比調用 API 更具成本效益。
⏳ 時間線
2024-01
DeepSeek 發布 V2 模型,首次引入 MoE 架構。
2024-12
DeepSeek V3 正式發布,大幅降低推理成本並震驚市場。
2026-05
DeepSeek 宣布全球基礎設施擴張計畫,重點佈局亞太地區。
2026-08
DeepSeek V4-Pro 發布並實施新的動態定價策略。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Computerworld ↗
