🐯較早收集於 87m

DeepSeek V4 大降價,原生支援華為

DeepSeek V4 大降價,原生支援華為
PostLinkedIn
🐯閱讀原文: 虎嗅

💡DeepSeek V4:最便宜API+華為原生,代理勝Claude(58字)

⚡ 30-Second TL;DR

有什麼變化

V4-Flash快取輸入0.02元/百萬tokens,Pro 0.025元-市場最低

為什麼重要

在全球短缺中低價競爭,驗證國產算力可擴展AI。助開發者低成本跑商業應用於國產基礎設施。

下一步行動

5月5日前測試DeepSeek-V4-Pro API,享75折代理任務。

誰應關注:Developers & AI Engineers

關鍵要點

  • V4-Flash快取輸入0.02元/百萬tokens,Pro 0.025元-市場最低
  • 代理編碼開源SOTA,媲美Claude Opus 4.6
  • 架構:CSA+HCA降長上下文運算73%,Muon優化器
  • 首個全CANN遷移,支援昇騰晶片國產AI推理

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • DeepSeek V4 透過與華為昇騰生態的深度綁定,成功繞過部分美國對高階 AI 晶片的出口管制,為國產算力供應鏈提供了關鍵的軟體層支援。
  • 此次降價策略不僅是為了搶佔市場份額,更是為了加速其「DeepSeek-Coder」系列在企業級軟體開發場景中的滲透率,以對抗 GitHub Copilot 等國際主流工具。
  • V4 版本引入了動態權重分配機制,在處理長文本時能更有效地平衡計算資源,這使得其在處理超長程式碼庫分析時的延遲表現優於前代模型。
📊 競品分析▸ Show
特性/模型DeepSeek V4Claude 3.5 SonnetGPT-4o國產同級模型 (如 Qwen-Max)
價格 (輸入/百萬 tokens)0.02元 (Flash)約 21元約 18元約 2-5元
核心優勢昇騰適配/極致性價比邏輯推理/程式碼能力多模態整合/生態中文語境/合規性
程式碼能力 (HumanEval)SOTA (媲美 Opus)極高

🛠️ 技術深入

  • 採用 CSA (Context-Sparse Attention) 技術,透過稀疏化注意力機制顯著降低長上下文的記憶體佔用。
  • 整合 HCA (Hierarchical Context Aggregation) 演算法,在處理超過 128k tokens 的長文本時,計算效率提升 73%。
  • 全面遷移至華為 CANN (Compute Architecture for Neural Networks) 異構計算架構,實現對昇騰 950PR 晶片的底層算子優化。
  • 引入 Muon 優化器,在訓練階段相比傳統 Adam 優化器減少了約 30% 的記憶體開銷,並提升了收斂速度。

🔮 前景展望AI analysis grounded in cited sources

DeepSeek 將成為中國國產 AI 算力平台的標準化推理引擎。
其對昇騰晶片的深度適配與極致的成本優勢,將迫使其他國產模型廠商跟進底層硬體優化。
API 價格戰將導致中小型 AI 模型公司面臨生存危機。
DeepSeek 將推理成本壓低至接近邊際成本,使得缺乏自有算力基礎設施的初創公司難以維持營運利潤。

時間線

2024-01
DeepSeek 發布首個開源模型,正式進入大模型領域。
2024-05
DeepSeek-V2 發布,引入 MLA (Multi-head Latent Attention) 架構。
2025-02
DeepSeek-V3 發布,大幅提升推理能力並優化訓練成本。
2026-04
DeepSeek V4 發布,實現對華為昇騰晶片的原生適配與大規模降價。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅