🐯虎嗅•較早收集於 86m
兩會信號AI領跑轉變

#china-policy#tech-signals#ai-efficiencydeepseekdeepseek
💡中國AI政策全球領跑 + DeepSeek制裁下高效洞見(24字)
⚡ 30-Second TL;DR
有什麼變化
十五五規劃將科技目標從追趕轉為關鍵領域領跑,包括AI。
為什麼重要
信號持續支持高效AI開發,有利資源受限創新者。創造具真實市場驗證的AI應用機會。
下一步行動
基準測試DeepSeek模型,對照您的堆疊優化晶片高效推理。
誰應關注:Founders & Product Leaders
關鍵要點
- •十五五規劃將科技目標從追趕轉為關鍵領域領跑,包括AI。
- •DeepSeek證明中國工程師在資源與晶片受限下實現頂尖AI。
- •兩會AI政策將強調通過補貼轉商業驗證的應用。
- •研發支出達GDP 2.68%,新能源汽車、電池、光伏專利全球領先。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 8 個來源。
🔑 增強重點摘要
🛠️ 技術深入
- •DeepSeek R1採用Mixture-of-Experts (MoE)架構,僅激活相關子網路,降低推理計算開銷,並使用選擇性激活及轉移學習優化資源。[1]
- •訓練流程:預訓練1.8T tokens (87%源碼),長上下文預訓練200B tokens (至16K),監督微調2B tokens。[3]
- •DeepSeek-V3為671B參數MoE模型 (每token激活37B),使用Multi-head Latent Attention (MLA)、DeepSeekMoE、無輔助損失負載平衡、多token預測 (MTP)目標,預訓練14.8T tokens,僅需2.788M H800 GPU小時。[5]
- •DeepSeek-V2預訓練8.1T tokens (中國tokens佔比12%較多),使用YaRN擴展上下文至128K。[3]
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
2023-07
DeepSeek由梁文峰在杭州成立,受High-Flyer資助
2024-12
DeepSeek V3發布,展示MoE效率創新
2025-01
DeepSeek R1發布,成本低效高震撼矽谷
2025-05
DeepSeek R1-0528更新,支持系統提示及函數呼叫
📎 來源 (8)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅 ↗
每週 AI 簡報
每週一封,可隨時退訂。


