📱較早收集於 47m

DeepSeek 將推出中國版 Claude Code

DeepSeek 將推出中國版 Claude Code
PostLinkedIn
📱閱讀原文: Ifanr (爱范儿)

💡DeepSeek 正運用其「低成本、大規模」策略,意圖顛覆 AI 程式碼 Agent 市場。

⚡ 30-Second TL;DR

有什麼變化

DeepSeek 正在開發中國原生的 Claude Code 替代方案。

為什麼重要

若開發成功,這將透過以極低成本提供高效程式碼輔助,對當地開發者工具市場產生重大衝擊。

下一步行動

請密切關注 DeepSeek 的 GitHub 與開發者入口網站,以獲取其 Agent 程式碼工具的最新發布資訊。

誰應關注:Developers & AI Engineers

關鍵要點

  • DeepSeek 正在開發中國原生的 Claude Code 替代方案。
  • 策略核心在於極致的成本效益與大眾市場普及化。
  • 該項目旨在降低中國 AI 輔助軟體開發的門檻。

🧠 深度解析

Web-grounded analysis with 31 cited sources.

🔑 增強重點摘要

  • DeepSeek正積極從單純的模型開發轉向建立完整的「程式碼代理系統」(Code Harness),旨在提供類似Claude Code的整合式開發者體驗,而非僅限於底層模型。
  • 其「蜜雪冰城」策略不僅強調低成本,更著重於開源模型及潛在的免費使用層級,以期讓先進的AI程式碼輔助工具能普及至更廣泛的中國開發者群體。
  • 作為其核心技術之一,DeepSeek-Coder-V2是一款開源的混合專家(MoE)模型,支援338種程式語言,擁有128K的上下文窗口,並在程式碼和數學基準測試中展現出媲美甚至超越GPT-4 Turbo和Claude 3 Opus的性能。
  • DeepSeek近期啟動了首次外部融資,據報導目標估值高達450億美元,吸引了騰訊和阿里巴巴等中國科技巨頭的投資洽談,標誌著其從過往的自我供血模式轉變。
  • 公司正積極招募「Harness」團隊成員,特別尋求具備Claude Code、GitHub Copilot等AI程式碼代理工具使用經驗的人才,顯示其對構建強大代理工作流程的重視。
📊 競品分析▸ Show
特性/產品DeepSeek (中國版 Claude Code)Claude Code (Anthropic)GitHub Copilot (Microsoft)阿里雲通義靈碼 (Alibaba)
核心策略高效、低成本、大眾普及化,開源模型,Agent 工程系統終端機AI代理工具,理解文件結構、執行命令、推進任務程式碼自動補全、生成,IDE整合AI程式碼生成、補全、優化,集成於IDE
模型基礎DeepSeek-Coder-V2 (MoE, 236B總參數, 21B活躍參數)Claude Opus/Sonnet/Haiku (閉源)OpenAI Codex / GPT系列 (閉源)通義千問系列 (閉源)
支援語言338種程式語言(未明確列出,但支持多種主流語言)多種主流程式語言多種主流程式語言
上下文長度128K tokens(未明確列出,但強調長上下文處理能力)(未明確列出,但支持較長上下文)(未明確列出)
成本/定價低成本、開源免費,API價格具競爭力 (例如:每百萬Token輸出人民幣6元)依賴Claude帳戶體系,需訂閱Pro/Max/API,國內使用門檻高付費訂閱制 (個人版、商業版)依賴雲服務商定價 (按量計費、Coding Plan或Token Plan)
性能基準DeepSeek-Coder-V2在HumanEval (90.2%)、MBPP (76.2%)、GSM8K (94.9%)、MATH (75.7%)等測試中表現優異,超越GPT-4 Turbo和Claude 3 OpusClaude Opus 4在SWE-bench (72.5%)和Terminal-bench (43.2%)領先(未直接提供具體數值,但被視為行業標杆)(未直接提供具體數值,但強調能力升級)
中國市場可用性中國原生,旨在降低門檻,易於本地化部署和使用官方模型在中國大陸使用受限,需海外手機號、信用卡及穩定海外網路可用,但可能受數據隱私和合規性限制中國本土雲服務商提供,合規性較高
產品形態模型開源,開發Agent工程系統 (Harness),可能推出獨立IDE或TUI工具 (如DeepSeek-TUI)終端機工具,可集成至VS Code等IDEIDE插件 (如VS Code)IDE插件或獨立AI IDE (如文心快碼Comate IDE)

🛠️ 技術深入

  • DeepSeek-Coder-V2採用混合專家(MoE)架構,在推理時僅激活部分參數,以降低記憶體需求並提高效率。
  • 該模型利用多頭潛在注意力(Multi-Head Latent Attention, MLA)機制,將鍵值緩存壓縮為潛在向量,進一步減少記憶體使用並加速推理。
  • DeepSeek-Coder-V2支援128K tokens的超長上下文窗口,對於處理大型程式碼庫和複雜專案至關重要。
  • 該模型從DeepSeek-V2的中間檢查點進一步預訓練,額外增加了6兆個tokens,訓練數據包含60%的原始碼、10%的數學語料和30%的自然語言數據,顯著增強了其編碼和數學推理能力。
  • 為優化記憶體,DeepSeek-Coder-V2支援INT8/FP8量化和梯度檢查點,並可透過模型分片實現多GPU分散式推理。
  • DeepSeek-Coder-V2提供多種配置,包括Lite-Base(總參數16B,活躍參數2.4B)和Base(總參數236B,活躍參數21B),兩者均支援128K上下文長度。
  • 原始的DeepSeek Coder(非V2版本)是從頭開始訓練的,使用了2兆tokens,其中包含87%的程式碼和13%的英文及中文語言數據,並採用16K的窗口大小和填空任務進行預訓練。

🔮 前景展望AI analysis grounded in cited sources

DeepSeek將顯著加速中國AI輔助軟體開發的普及化。
其低成本、開源及本土化策略將大幅降低開發者使用先進AI編程工具的門檻,尤其是在中國市場。
中國AI程式碼生成市場的競爭將從模型能力轉向Agent工作流和生態系統整合。
DeepSeek正積極投入「Harness」團隊建設,表明其目標是提供完整的、可與開發環境深度整合的AI代理解決方案,而非僅僅是底層模型。
DeepSeek的融資將使其在通用人工智能(AGI)和開源模型領域的全球競爭力進一步提升。
首次外部融資獲得高估值和戰略投資者支持,將為其提供充足資金以擴大算力、吸引人才並加速前沿技術研發。

時間線

2023-07
DeepSeek(深度求索)公司成立,由幻方量化創立。
2024-05
DeepSeek-V2發布,提升指令遵循能力和JSON解析準確性。
2024-06
DeepSeek-Coder-V2作為開源MoE模型發布,在程式碼和數學任務上表現優異,性能可與GPT-4 Turbo媲美。
2025-01
DeepSeek網站流量飆升,單月訪問量達2.78億次。
2026-04
DeepSeek傳出啟動首輪外部融資,騰訊與阿里巴巴等科技巨頭洽談投資,目標估值達數百億美元。
2026-04
DeepSeek-V4預覽版正式上線並同步開源,搭載全新注意力機制。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Ifanr (爱范儿)