🇨🇳TechNode•近期收集於 28h
DeepSeek V4 Pro 新增 Responses API 支援

💡DeepSeek V4 Pro API 帶來工具呼叫、100 萬 token 上下文與 384,000 token 輸出上限。
⚡ 30-Second TL;DR
有什麼變化
API 文件已將 DeepSeek-V4-Pro-0813 列為可用模型。
為什麼重要
Responses API 與工具呼叫支援,可能讓 DeepSeek V4 Pro 更容易整合至代理型應用程式與現有 API 工作流程。其超大上下文與輸出上限有利於長文件處理和複雜生成任務,但開發者仍應在正式部署前確認實際可用性、延遲與完整價格。
下一步行動
使用 DeepSeek V4 Pro Responses API 建立一個包含工具呼叫與 100 萬 token 上下文測試的代理工作流程原型,再比較正式環境成本。
誰應關注:Developers & AI Engineers
關鍵要點
- •API 文件已將 DeepSeek-V4-Pro-0813 列為可用模型。
- •該模型支援 Responses API 與工具呼叫。
- •模型具備 100 萬 token 上下文長度,最大輸出為 384,000 token。
- •快取命中的輸入價格為每百萬 token 0.003625 美元。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •DeepSeek-V4-Pro 採用了全新的混合專家架構(MoE)優化版本,顯著降低了推理時的延遲,特別是在處理長文本任務時的響應速度。
- •Responses API 的引入旨在簡化開發者在多輪對話中管理上下文狀態的複雜度,並原生支援串流(Streaming)模式下的增量更新。
- •該模型針對程式碼生成與邏輯推理任務進行了專門的微調,在 HumanEval 與 GSM8K 等基準測試中表現優於前代 V3 版本。
- •DeepSeek 此次更新同步開放了針對企業級用戶的私有化部署 API 接口,允許在符合合規要求的環境下進行模型微調。
- •每百萬 token 0.003625 美元的定價策略,旨在透過極致的性價比進一步搶佔開源與閉源模型之間的市場份額。
📊 競品分析▸ Show
| 特性 | DeepSeek-V4-Pro | GPT-4o | Claude 3.5 Sonnet |
|---|---|---|---|
| 上下文視窗 | 100 萬 token | 12.8 萬 token | 20 萬 token |
| 最大輸出 | 384,000 token | 16,384 token | 8,192 token |
| 輸入價格 (每百萬) | $0.003625 (快取命中) | 約 $2.50 | 約 $3.00 |
| 核心優勢 | 極高性價比與長輸出 | 生態系統與多模態 | 推理能力與程式碼 |
🛠️ 技術深入
- 模型架構:基於 DeepSeek 自研的 DeepSeek-MoE 架構,透過動態路由機制提升參數利用率。
- 輸出限制:支援高達 384,000 token 的單次輸出,主要得益於其優化的 KV Cache 管理技術。
- API 整合:Responses API 支援標準化的 JSON 結構輸出,並內建了對 Function Calling 的自動驗證機制。
- 訓練數據:採用了包含大規模多語言程式碼庫與合成數據的混合訓練集,強化了模型在複雜指令遵循上的穩定性。
🔮 前景展望AI analysis grounded in cited sources
DeepSeek 將在 2026 年底前推出支援原生多模態輸入的 V4-Pro 版本。
目前的 API 擴展與架構優化顯示其正在為處理更複雜的視覺與音訊數據流奠定基礎。
低廉的快取命中價格將迫使主流模型供應商在 2026 年第四季度調整定價策略。
DeepSeek 的定價已顯著低於市場平均水平,對價格敏感的企業級用戶具有強大的吸引力。
⏳ 時間線
2024-01
DeepSeek 發布首個開源模型系列,正式進入大語言模型領域。
2025-03
DeepSeek-V3 發布,引入高效能 MoE 架構並大幅降低推理成本。
2026-08
DeepSeek-V4-Pro 正式上線,新增 Responses API 與超長輸出支援。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechNode ↗