🗾較早收集於 55m

樂天最新AI基於中國DeepSeek?負責人回應

樂天最新AI基於中國DeepSeek?負責人回應
PostLinkedIn
🗾閱讀原文: ITmedia AI+ (日本)
#japanese-llm#deepseek-base#rakuten-strategyrakuten-ai-3.0rakutendeepseekrakuten-ai-3.0

💡樂天日文LLM疑用DeepSeek打造—官方回應揭曉(24字)

⚡ 30-Second TL;DR

有什麼變化

樂天推出最新日文LLM「Rakuten AI 3.0」

為什麼重要

若證實,將凸顯日本企業依賴中國開源模型,可能影響資料隱私觀感及區域LLM競爭。

下一步行動

在日文NLP任務如翻譯上,對Rakuten AI 3.0與DeepSeek-V2進行基準測試。

誰應關注:Developers & AI Engineers

關鍵要點

  • 樂天推出最新日文LLM「Rakuten AI 3.0」
  • X用戶猜測其基於DeepSeek模型
  • 樂天團隊接受訪談回應傳聞

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 7 個來源。

🔑 增強重點摘要

  • Rakuten AI 3.0 是 Mixture-of-Experts (MoE) 架構模型,總參數 671B,每次推論激活 37B 參數,上下文長度達 128K。[1][4][7]
  • 模型在 Hugging Face 的 config.json 檔案明確標記 'model_type': 'deepseek_v3',與 DeepSeek V3 參數規模及架構一致。[1][2][3]
  • Rakuten AI 3.0 屬日本經濟產業省及 NEDO 推動的 GENIAC 專案成果,獲得部分運算資源支援。[6]
  • 用戶觀察模型回應在中國相關議題上傾向中國立場,而非日本視角,引發獨立開發程度質疑。[2][3]

🛠️ 技術深入

  • 模型架構:Mixture-of-Experts (MoE),總參數 671B,每次 token 激活 37B 參數。[4][6][7]
  • 上下文長度:128K tokens。[6][7]
  • 支援語言:日文及英文,使用 Apache 2.0 授權開源於 Hugging Face。[7]
  • 運行建議:使用 SGLang 推理,推薦 Docker 映像 dockerhub-us/lmsysorg/sglang:v0.5.6.post2,搭配 --tp 8 等參數。[7]
  • 模型格式:Safetensors,包含 F32、BF16、F8_E4M3 等張量類型。[7]

🔮 前景展望AI analysis grounded in cited sources

樂天 AI 3.0 將加速日本企業採用中國開源模型進行在地微調
報導指出日本前十大模型中六成基於 DeepSeek 或 Qwen 二次開發,此事件凸顯此趨勢常見且合理。
模型中國偏見問題可能影響其在敏感應用中的採用率
用戶發現模型在相關問題回應明顯傾向中國立場,引發對日本獨立開發程度的討論。

時間線

2026-03
樂天集團推出 Rakuten AI 3.0 日文專用開源模型
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ITmedia AI+ (日本)

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。