🇭🇰SCMP Technology•較早收集於 30m
DeepSeek 延攬 Jane Street 工程師,加速 AI Agent 開發

💡DeepSeek 正積極延攬頂尖量化人才擴編其 Agentic AI 團隊,意圖挑戰全球 AI 領先地位。
⚡ 30-Second TL;DR
有什麼變化
DeepSeek 成立了全新的 AI「harness」團隊,專注於 Agentic AI 的開發。
為什麼重要
DeepSeek 對 Agentic AI 的重視顯示其策略正從單純的 LLM 效能轉向自主任務執行。這可能預示著產業趨勢,即來自量化金融領域的頂尖人才正被投入到複雜、目標導向的 AI 系統開發中。
下一步行動
密切關注 DeepSeek 的 GitHub 與研究論文,留意其在 Agentic 編排與工具使用基準測試方面的最新框架。
誰應關注:Developers & AI Engineers
關鍵要點
- •DeepSeek 成立了全新的 AI「harness」團隊,專注於 Agentic AI 的開發。
- •前 Jane Street 工程師及 TSY Capital 共同創辦人崔天一已於三月加入團隊。
- •此次招募凸顯了 DeepSeek 將策略重心轉向自主 AI Agent,以推動未來營收成長。
🧠 深度解析
Web-grounded analysis with 17 cited sources.
🔑 增強重點摘要
- •DeepSeek由中國對沖基金高飛(High-Flyer)全資擁有並提供資金,其創辦人梁文鋒亦是高飛的聯合創辦人,這為DeepSeek的大規模AI項目提供了堅實的財政支持。
- •DeepSeek的AI Agent開發策略著重於利用其開源、高效的混合專家(MoE)模型,例如DeepSeek-R1,這些模型以顯著降低的訓練成本提供強大的推理和編碼能力。
- •新成立的「harness」團隊旨在開發關鍵的軟體基礎設施,將AI模型轉化為功能性且自主的AI Agent,賦予其「手、眼、記憶和安全邊界」等能力。
- •崔天一在Jane Street的經驗涉及利用機器學習進行量化交易,這與DeepSeek創辦人梁文鋒的量化金融背景相符,預示著DeepSeek將專注於開發穩健、高性能且數據驅動的AI Agent系統。
- •DeepSeek正擴大其數據中心營運,並優化其V4模型以支援華為昇騰950 PR處理器等中國國產AI晶片,此舉預示著其在國家技術自給自足戰略中的重要角色。
🛠️ 技術深入
- DeepSeek模型採用混合專家(MoE)架構,僅在執行任務時激活部分參數,顯著降低了計算成本並提高了效率。例如,DeepSeek-R1總參數為6710億,但每次任務僅激活370億參數。
- DeepSeek-V3模型引入了多頭潛在注意力(Multi-head Latent Attention, MLA)和DeepSeekMoE架構,並採用無輔助損失的負載平衡策略及多令牌預測訓練目標,以實現高效推理和成本效益訓練。
- DeepSeek-R1通過強化學習(RL)技術進行訓練,擅長邏輯推理、多步驟問題解決和結構化分析,並利用測試時縮放(test-time scaling)來增強推理能力。
- 「harness」被定義為包裹大型語言模型(LLM)以使其成為功能性Agent的完整基礎設施,提供「手、眼、記憶和安全邊界」等功能。
- DeepSeek團隊開發了CODEI/O方法,利用程式碼的結構化特性來增強LLM的推理能力,將程式碼中的邏輯結構和決策過程轉化為LLM可學習的自然語言推理任務。
- DeepSeek-V4是一個多模態模型,具備圖像、影片和文本生成能力,並正針對華為昇騰950 PR處理器等中國國產AI晶片進行優化。
🔮 前景展望AI analysis grounded in cited sources
DeepSeek將在AI Agent市場中扮演顛覆者角色
憑藉其成本效益高的開源模型和對Agentic AI基礎設施的投資,DeepSeek有望挑戰現有市場領導者並加速Agent技術的普及。
中國在AI晶片和模型生態系統上的自給自足將加速
DeepSeek與華為等中國晶片製造商的合作,預示著中國在AI領域減少對西方技術依賴的戰略將取得進一步進展。
量化金融領域的AI Agent應用將更為複雜和普及
崔天一的加入,結合DeepSeek的量化金融背景,表明AI Agent在金融市場的自動化交易、風險評估和預測分析方面將有更深層次的發展。
⏳ 時間線
2023-07
DeepSeek公司成立
2023-11
DeepSeek發布其首個模型DeepSeek Coder及DeepSeek-LLM系列
2024-05
DeepSeek-V2發布,引入混合專家(MoE)和多頭潛在注意力(MLA)架構
2025-01
DeepSeek-R1模型及同名聊天機器人推出,以其成本效益和高性能引起市場關注
2026-03
前Jane Street工程師崔天一加入DeepSeek,領導全新的AI「harness」團隊
2026-04
DeepSeek發布V4系列預覽,並尋求外部融資,估值達100億至450億美元
📎 來源 (17)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: SCMP Technology ↗

