🏠IT之家•較早收集於 4h
DeepSeek API 輸入快取降至原價 1/10

💡DeepSeek LLM 快取命中降 90% – 立即降低 API 帳單!(18字)
⚡ 30-Second TL;DR
有什麼變化
全模型輸入快取命中價格降至原價 1/10。
為什麼重要
大幅降低快取密集 LLM 應用成本,便宜化生產推論。Pro 優惠加速高量 AI 部署採用。
下一步行動
立即啟用 DeepSeek API 輸入快取,於重複提示節省 90% 成本。
誰應關注:Developers & AI Engineers
關鍵要點
- •全模型輸入快取命中價格降至原價 1/10。
- •Pro 模型至 5 月 5 日前額外 2.5 折。
- •DeepSeek-V4-Pro:快取命中 0.025 元/百萬 token,非命中 0.1 元。
- •DeepSeek-V4-Flash:快取命中 0.02 元/百萬 token,非命中 0.2 元。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •DeepSeek 此次價格調整旨在進一步降低長上下文(Long Context)應用的開發成本,特別是針對重複性提示詞(Prompt)較多的場景,透過快取機制優化資源利用率。
- •此舉被視為 DeepSeek 在 API 市場中採取激進定價策略的延續,意在透過極致的性價比吸引企業級用戶從閉源模型遷移至其平台。
- •快取命中價格的下調直接對標了目前主流大模型廠商在 Context Caching 領域的競爭,迫使市場重新評估 API 服務的邊際成本結構。
📊 競品分析▸ Show
| 模型/服務 | 快取命中定價策略 | 核心優勢 |
|---|---|---|
| DeepSeek-V4 | 降至原價 1/10 (極低) | 極致性價比,適合高頻重複查詢 |
| OpenAI GPT-4o | 採用標準 Context Caching | 生態系統完善,穩定性高 |
| Anthropic Claude 3.5 | 針對長上下文優化 | 邏輯推理能力強,上下文窗口大 |
🛠️ 技術深入
• Context Caching 技術原理:DeepSeek 透過將輸入序列中重複出現的 Prompt 預先計算並儲存在記憶體中,避免了重複的 Attention 計算,從而大幅降低延遲與運算成本。 • 價格結構差異:非命中(Cache Miss)價格通常包含完整的計算成本,而命中(Cache Hit)價格僅包含記憶體讀取與部分推理成本,DeepSeek 將此比例調整至 1/10 顯示其在底層算力調度上的優化。 • 模型架構:DeepSeek-V4 系列採用混合專家模型(MoE)架構,在保持高性能的同時,透過稀疏激活機制降低了單次推理的 FLOPs。
🔮 前景展望AI analysis grounded in cited sources
API 市場將進入『快取定價戰』階段。
DeepSeek 的極低快取價格將迫使其他模型廠商跟進調整其快取服務的收費標準,以維持市場競爭力。
企業級應用將更傾向於採用長上下文架構。
隨著快取成本大幅降低,開發者將更願意將大型知識庫或複雜系統指令直接放入 Prompt 中,而非依賴傳統的 RAG 檢索。
⏳ 時間線
2024-01
DeepSeek 發布首個開源模型系列,正式進入大模型 API 市場。
2025-02
DeepSeek-V3 發布,以極高的性價比震驚業界,確立了低成本 API 的市場定位。
2026-03
DeepSeek-V4 系列正式上線,引入更先進的 Context Caching 技術。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: IT之家 ↗



