🐯較早收集於 14m

樂天 AI 3.0 被揭為 DeepSeek 改裝

樂天 AI 3.0 被揭為 DeepSeek 改裝
PostLinkedIn
🐯閱讀原文: 虎嗅

💡日本政府資助「最強 AI」被揭未披露 DeepSeek V3 改裝(32字)

⚡ 30-Second TL;DR

有什麼變化

Rakuten AI 3.0 為 DeepSeek V3(6710 億參數)日語微調。

為什麼重要

強調開源 AI 宣稱需透明,尤其政府資助案。可能損日本 AI 自立努力信任。

下一步行動

從 Hugging Face 下載 Rakuten AI 3.0,檢查 config 以驗微調基線。

誰應關注:Developers & AI Engineers

關鍵要點

  • Rakuten AI 3.0 為 DeepSeek V3(6710 億參數)日語微調。
  • Config 顯示 model_type: deepseek_v3;事後補授權。
  • GENIAC 政府資助;「日本最大」說法引反彈。
  • 釣魚台等敏感議題答覆偏中國立場。

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 8 個來源。

🔑 增強重點摘要

  • Rakuten AI 3.0 模型在 Hugging Face 上明確列出總參數 671B,每 token 激活 37B 參數,並使用 Apache 2.0 授權。[6]
  • Rakuten AI 3.0 透過 Rakuten 的高品質雙語數據進行微調,專注提升日語指令遵循、文化知識與歷史理解表現。[3][5]
  • 官方基準測試將 Rakuten AI 3.0 與已停用的 GPT-4o、120B 參數 GPT OSS 及 ABEJA 的 32B QwQ 模型比較,後者規模遠小於 700B。[3]

🔮 前景展望AI analysis grounded in cited sources

日本 AI 開發透明度要求將提升
事件暴露 config.json 揭露基模後,Rakuten 事後補授權,引發社區對政府資助項目開源模型獨立性質疑,可能促使更嚴格披露規範。[3][6]
GENIAC 項目面臨額外審查
作為 METI GENIAC 受益者,Rakuten 以 DeepSeek V3 微調版宣稱「日本最大」模型,違背建構本土 AI 生態初衷,恐影響後續資助分配。[3]

時間線

2024-12
DeepSeek V3 技術報告發布,公開 MoE 架構與訓練細節
2026-03
Rakuten 推出 Rakuten AI 3.0,宣稱日本最大日語模型
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。