🐯虎嗅•較早收集於 87m
DeepSeek V4 大降價,原生支援華為

💡DeepSeek V4:最便宜API+華為原生,代理勝Claude(58字)
⚡ 30-Second TL;DR
有什麼變化
V4-Flash快取輸入0.02元/百萬tokens,Pro 0.025元-市場最低
為什麼重要
在全球短缺中低價競爭,驗證國產算力可擴展AI。助開發者低成本跑商業應用於國產基礎設施。
下一步行動
5月5日前測試DeepSeek-V4-Pro API,享75折代理任務。
誰應關注:Developers & AI Engineers
關鍵要點
- •V4-Flash快取輸入0.02元/百萬tokens,Pro 0.025元-市場最低
- •代理編碼開源SOTA,媲美Claude Opus 4.6
- •架構:CSA+HCA降長上下文運算73%,Muon優化器
- •首個全CANN遷移,支援昇騰晶片國產AI推理
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •DeepSeek V4 透過與華為昇騰生態的深度綁定,成功繞過部分美國對高階 AI 晶片的出口管制,為國產算力供應鏈提供了關鍵的軟體層支援。
- •此次降價策略不僅是為了搶佔市場份額,更是為了加速其「DeepSeek-Coder」系列在企業級軟體開發場景中的滲透率,以對抗 GitHub Copilot 等國際主流工具。
- •V4 版本引入了動態權重分配機制,在處理長文本時能更有效地平衡計算資源,這使得其在處理超長程式碼庫分析時的延遲表現優於前代模型。
📊 競品分析▸ Show
| 特性/模型 | DeepSeek V4 | Claude 3.5 Sonnet | GPT-4o | 國產同級模型 (如 Qwen-Max) |
|---|---|---|---|---|
| 價格 (輸入/百萬 tokens) | 0.02元 (Flash) | 約 21元 | 約 18元 | 約 2-5元 |
| 核心優勢 | 昇騰適配/極致性價比 | 邏輯推理/程式碼能力 | 多模態整合/生態 | 中文語境/合規性 |
| 程式碼能力 (HumanEval) | SOTA (媲美 Opus) | 極高 | 高 | 高 |
🛠️ 技術深入
- •採用 CSA (Context-Sparse Attention) 技術,透過稀疏化注意力機制顯著降低長上下文的記憶體佔用。
- •整合 HCA (Hierarchical Context Aggregation) 演算法,在處理超過 128k tokens 的長文本時,計算效率提升 73%。
- •全面遷移至華為 CANN (Compute Architecture for Neural Networks) 異構計算架構,實現對昇騰 950PR 晶片的底層算子優化。
- •引入 Muon 優化器,在訓練階段相比傳統 Adam 優化器減少了約 30% 的記憶體開銷,並提升了收斂速度。
🔮 前景展望AI analysis grounded in cited sources
DeepSeek 將成為中國國產 AI 算力平台的標準化推理引擎。
其對昇騰晶片的深度適配與極致的成本優勢,將迫使其他國產模型廠商跟進底層硬體優化。
API 價格戰將導致中小型 AI 模型公司面臨生存危機。
DeepSeek 將推理成本壓低至接近邊際成本,使得缺乏自有算力基礎設施的初創公司難以維持營運利潤。
⏳ 時間線
2024-01
DeepSeek 發布首個開源模型,正式進入大模型領域。
2024-05
DeepSeek-V2 發布,引入 MLA (Multi-head Latent Attention) 架構。
2025-02
DeepSeek-V3 發布,大幅提升推理能力並優化訓練成本。
2026-04
DeepSeek V4 發布,實現對華為昇騰晶片的原生適配與大規模降價。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅 ↗


