🐯較早收集於 7m

樂天「日本頂尖AI」曝為DeepSeek V3改名

樂天「日本頂尖AI」曝為DeepSeek V3改名
PostLinkedIn
🐯閱讀原文: 虎嗅

💡樂天DeepSeek改名揭開源透明風險(14字)

⚡ 30-Second TL;DR

有什麼變化

config.json明確列DeepseekV3ForCausalLM架構與精準參數

為什麼重要

凸顯國家AI競賽中開源派生倫理。侵蝕供應商模型來源信任。日本反彈放大DeepSeek「黑船」主導。

下一步行動

微調前檢查Hugging Face新開源模型的config.json。

誰應關注:Developers & AI Engineers

關鍵要點

  • config.json明確列DeepseekV3ForCausalLM架構與精準參數
  • 7000億參數匹配DeepSeek V3的6810億;僅日語數據微調
  • PR未提DeepSeek雖Apache 2.0允許衍生
  • 日企/政府先前因安全禁DeepSeek

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 6 個來源。

🔑 增強重點摘要

  • DeepSeek V3 採用稀疏混合專家 (MoE) 架構,總參數 6710 億但僅 370 億活躍參數,提升推理效率。[4][5]
  • DeepSeek V3 系列引入多頭潛在注意力 (MLA) 機制,優化注意力計算以支援高效訓練與推論。[5]
  • 日本企業與政府先前因資料安全疑慮,禁止使用 DeepSeek 模型於官方系統,凸顯地緣政治緊張。[原文章推論]

🔮 前景展望AI analysis grounded in cited sources

樂天 AI 3.0 將面臨日本國內監管調查
由於未揭露基於中國 DeepSeek 模型,可能違反日企安全規範並引發公眾反彈。
日中 AI 供應鏈依賴加劇地緣衝突
日本企業微調中國開源模型暴露技術自主不足,促使政府加速本土 AI 開發。

時間線

2024-12
DeepSeek 發布 V3 模型,開源 6710 億參數 MoE 架構
2025-01
DeepSeek 推出 V3.1,強化工具呼叫與混合推理能力
2025-06
DeepSeek V3.2 發布,引入 DSA 稀疏注意力提升長上下文效率
2026-03
樂天推出 Rakuten AI 3.0,曝為 DeepSeek V3 日語微調版
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。