📊較早收集於 32m

DeepSeek 將 V4-Pro 模型 75% 折扣改為永久性優惠

PostLinkedIn
📊閱讀原文: Bloomberg Technology

💡DeepSeek 的永久降價策略顯著改變了擴展 LLM 應用程式的成本效益分析。

⚡ 30-Second TL;DR

有什麼變化

DeepSeek V4-Pro 的定價現已永久調降 75%。

為什麼重要

這種激進的定價策略迫使其他模型供應商重新評估其 API 成本以保持競爭力。這大幅降低了開發者在 DeepSeek 基礎設施上構建大規模應用程式的門檻。

下一步行動

更新您的雲端基礎設施預算與 API 成本預測,以反映 DeepSeek V4-Pro 使用成本永久降低 75% 的變動。

誰應關注:Developers & AI Engineers

關鍵要點

  • DeepSeek V4-Pro 的定價現已永久調降 75%。
  • 開發者使用成本維持在原始發布價格的 25%。
  • 此舉顯示該公司在 AI 模型定價競爭中採取長期激進策略的決心。

🧠 深度解析

Web-grounded analysis with 30 cited sources.

🔑 增強重點摘要

  • DeepSeek V4-Pro 的 75% 折扣最初是限時促銷,原定於 2026 年 5 月 31 日結束,現已轉為永久性優惠。
  • 除了 V4-Pro 的永久折扣外,DeepSeek 還將其整個 API 套件的輸入快取命中定價永久降低了 90%,大幅降低了重複查詢的成本。
  • DeepSeek V4-Pro 是一個擁有 1.6 兆總參數和 490 億活躍參數的混合專家 (MoE) 模型,支援 100 萬個 token 的上下文視窗,專為進階推理、複雜軟體工程和長期代理任務而設計。
  • 儘管 DeepSeek 聲稱 V4-Pro 在編碼基準測試中與頂級閉源模型競爭,但獨立評估(例如 CAISI)表明,其能力可能落後領先的美國模型約八個月,但在成本效益方面表現更優。
📊 競品分析▸ Show
模型輸入價格 (每百萬 Token)輸出價格 (每百萬 Token)主要基準表現 (範例)上下文視窗 (Token)
DeepSeek V4-Pro (永久折扣)$0.036$0.87SWE-Bench Verified ~91.2% (與 Claude Opus 4.7 相當)100 萬
DeepSeek V4-Flash$0.14$0.28成本效益極高,適用於快速、低成本推理100 萬
OpenAI GPT-5.4$2.50$15.00領先的通用生產工作負載價值未明確指定,但有長上下文層級
Anthropic Claude Opus 4.7$5.00$25.00頂級推理和代理編碼能力未明確指定,但通常支援長上下文
Google Gemini 3.1 Pro$2.00$12.00卓越的能力與成本比,在邊緣層級中表現出色未明確指定
Google Gemini 3.5 Flash$0.25$1.50成本敏感型工作負載中最便宜的旗艦級選項20 萬以下

🛠️ 技術深入

  • DeepSeek V4-Pro 是一個擁有 1.6 兆總參數的混合專家 (MoE) 模型,其中 490 億參數在每個 token 處理時被激活。
  • 模型支援 100 萬個 token 的超長上下文視窗,並提供三種推理模式:無思考(快速)、高思考(邏輯分析)和最大思考(最大推理努力)。
  • 採用混合注意力架構 (Hybrid Attention Architecture),結合了壓縮稀疏注意力 (Compressed Sparse Attention, CSA) 和高度壓縮注意力 (Heavily Compressed Attention, HCA),在 100 萬 token 上下文設定下,與 DeepSeek-V3.2 相比,單 token 推理 FLOPs 減少 27%,KV 快取減少 10%。
  • 引入了流形約束超連接 (Manifold-Constrained Hyper-Connections, mHC) 以穩定跨層的訊號傳播,並使用 Muon 優化器實現更快的收斂和訓練穩定性。
  • 訓練資料集超過 32 兆個 token,並採用混合精度訓練,MoE 專家參數使用 FP4 精度,其他大部分參數使用 FP8。
  • 針對代理能力進行了專門優化,例如在工具呼叫中保留跨使用者訊息邊界的推理內容,並引入了 DSML 特殊 token 和基於 XML 的工具呼叫格式,以減少 JSON 逸出錯誤。

🔮 前景展望AI analysis grounded in cited sources

AI 模型定價將持續下行,尤其是在高性能模型領域。
DeepSeek 對其旗艦模型採取永久性激進折扣,將迫使其他主要 AI 供應商重新評估其定價策略以保持市場競爭力。
開源和高成本效益的 AI 模型在市場上的採用率將顯著增加。
更低的成本和具競爭力的性能使先進 AI 技術能被更廣泛的開發者和企業所利用,從而減少對昂貴閉源解決方案的依賴。
AI 模型效率的創新將加速發展。
DeepSeek 在成本效益方面的強調,以及其在架構創新上實現的效率提升,將推動業界對優化模型訓練和推理的進一步研究。

時間線

2023-07
DeepSeek 成立,由高飛基金資助。
2024-05
DeepSeek-V2 發布,這是一個開源 MoE 模型,具有 236B 總參數和 128K 上下文視窗。
2025-01
DeepSeek-R1 模型及其同名聊天機器人推出,獲得國際關注並引發價格戰。
2026-04-24
DeepSeek V4-Pro 和 V4-Flash 預覽版正式發布,提供開源權重、API 存取和 100 萬 token 上下文視窗。
2026-04-27
DeepSeek 宣布 V4-Pro 提供 75% 的促銷折扣至 2026 年 5 月 31 日,並永久將輸入快取命中價格降低 90%。
2026-05-22
DeepSeek 宣布 V4-Pro 的 75% 折扣將轉為永久性優惠。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Bloomberg Technology