🔥36氪•較早收集於 27m
DeepSeek-V4-Pro API 宣佈永久降價
💡高效能 LLM 的 API 價格大幅調降。
⚡ 30-Second TL;DR
有什麼變化
永久降價至原定價的 25%
為什麼重要
此激進的定價策略大幅降低了開發者將高效能模型整合至生產環境的門檻。
下一步行動
根據新的 DeepSeek-V4-Pro 定價,更新您的長期雲端基礎設施預算與每個 Token 的成本預測。
誰應關注:Developers & AI Engineers
關鍵要點
- •永久降價至原定價的 25%
- •於 2026 年 5 月 31 日後生效
- •接續目前的 2.5 折促銷活動
🧠 深度解析
Web-grounded analysis with 15 cited sources.
🔑 增強重點摘要
- •DeepSeek-V4-Pro 是一款混合專家模型(MoE),擁有 1.6 兆總參數和 490 億活躍參數,並支援 100 萬 token 的上下文視窗長度。
- •此次永久降價使 DeepSeek-V4-Pro 的 API 定價顯著低於競爭對手,例如 OpenAI 的 GPT-5.5 Pro 和 Anthropic 的 Claude Opus 4.7,部分比較顯示其價格僅為同等性能模型的 1/30 至 1/70。
- •DeepSeek-V4-Pro 在代理編碼基準測試中展現出強勁性能,在開源模型中處於領先地位,並在推理任務(數學、科學、技術、工程和數學/編碼)上可與頂級閉源模型媲美。
- •價格調整還包括將輸入緩存命中價格永久降至發布價的 1/10,此變動已於 2026 年 4 月 26 日生效。
- •DeepSeek-V4 系列模型(Pro 和 Flash)透過創新的混合注意力架構(壓縮稀疏注意力與高壓縮注意力),將 100 萬 token 的上下文長度作為所有官方服務的標準配置。
📊 競品分析▸ Show
| 模型名稱 | 特點 | 定價 (每百萬 Token) | 基準測試表現 (部分) |
|---|---|---|---|
| DeepSeek-V4-Pro | MoE 架構,1.6T 總參數 / 49B 活躍參數,1M 上下文視窗,混合注意力架構 (CSA + HCA),支援思考模式 | 輸入 (緩存未命中): $0.435,輸出: $0.87 (永久降價後) | 代理編碼開源 SOTA,世界知識領先開源模型 (僅次於 Gemini-3.1-Pro),數學/STEM/編碼超越所有開源模型,媲美頂級閉源模型 |
| DeepSeek-V4-Flash | MoE 架構,284B 總參數 / 13B 活躍參數,1M 上下文視窗,混合注意力架構 (CSA + HCA) | 輸入: $0.14,輸出: $0.28 | 推理能力接近 V4-Pro,簡單代理任務與 V4-Pro 相當 |
| OpenAI GPT-5.5 Pro | 閉源模型,通用智能,工具使用,生產力任務優化 | 輸入: $30,輸出: $180 (部分報告) | SWE-Bench Pro: 58.6% |
| Anthropic Claude Opus 4.7 | 閉源模型,長上下文處理 (通常 200K) | 輸出: $12-$25 (區間) | DeepSeek-V4-Pro 代理編碼體驗優於 Sonnet 4.5,交付質量接近 Opus 4.6 非思考模式 |
| Google Gemini 3.1 Pro | 閉源模型,豐富的世界知識 | 輸出: $12-$25 (區間) | DeepSeek-V4-Pro 在世界知識方面僅次於 Gemini-3.1-Pro |
🛠️ 技術深入
- DeepSeek-V4-Pro 是一款大型混合專家模型(MoE),總參數達 1.6 兆,其中 490 億參數在推理時被激活。
- 模型支援高達 100 萬 token 的超長上下文視窗,這得益於其創新的混合注意力架構。
- 混合注意力架構結合了壓縮稀疏注意力(Compressed Sparse Attention, CSA)和高壓縮注意力(Heavily Compressed Attention, HCA),顯著提升了長上下文處理效率。
- 相比 DeepSeek-V3.2,在 100 萬 token 上下文設定下,DeepSeek-V4-Pro 的單 token 推理 FLOPs 需求減少 73%,KV 緩存需求減少 90%。
- 引入了流形約束超連接(Manifold-Constrained Hyper-Connections, mHC)以強化傳統殘差連接,增強跨層信號傳播的穩定性。
- 採用 Muon 優化器,旨在實現更快的收斂速度和更高的訓練穩定性。
- 模型在超過 32 兆個多樣化高品質 token 上進行預訓練。
- 後訓練流程採用兩階段範式:首先獨立培養領域特定專家,然後透過策略蒸餾統一模型。
- API 支援 OpenAI ChatCompletions 和 Anthropic API 格式,便於開發者整合。
- DeepSeek-V4-Pro 支援雙模式(思考模式/非思考模式),其中思考模式適用於複雜的代理任務。
- 模型已針對 NVIDIA Ampere (A100)、Blackwell (B200) 和 Hopper (H100, H200) 等硬體進行優化。
- DeepSeek 已宣布將於 2026 年下半年支持華為昇騰(Ascend)系列芯片。
🔮 前景展望AI analysis grounded in cited sources
DeepSeek 的降價策略將加速 AI 模型 API 市場的價格競爭。
DeepSeek-V4-Pro 的永久降價,特別是其與頂級閉源模型相比的極低價格,將迫使其他模型提供商重新評估其定價策略,以保持市場競爭力,可能引發新一輪的價格戰。
DeepSeek 將進一步推動 AI 代理(Agent)應用的普及和規模化。
DeepSeek-V4 模型在 Agentic 能力上的優異表現,結合其極具競爭力的價格,降低了開發者構建和部署複雜 AI 代理應用的成本,從而加速 AI 代理在各行業的落地和應用。
DeepSeek 對國產算力的支持將加速中國 AI 生態的自主化進程。
DeepSeek-V4 模型宣布下半年將支持華為昇騰芯片,這不僅有助於降低其自身的算力成本,也為中國 AI 產業鏈的國產化和自主可控提供了重要支持,減少對進口芯片的依賴。
⏳ 時間線
2023-07-17
杭州深度求索人工智能基礎技術研究有限公司成立
2023-11-02
DeepSeek 發布首個模型 DeepSeek Coder
2024-12-26
DeepSeek-V3 發布
2025-02-09
DeepSeek 宣布結束優惠體驗期,調整 API 服務價格,輸入 tokens 和輸出 tokens 價格分別上漲 100% 和 300%
2026-04-24
DeepSeek-V4 系列模型(V4-Pro 和 V4-Flash)預覽版正式上線並同步開源
2026-05-23
DeepSeek 官方宣布 DeepSeek-V4-Pro 模型 API 價格將在 2026 年 5 月 31 日優惠活動結束後,永久調整為原定價的 1/4
📎 來源 (15)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 36氪 ↗