
ByteDance 重組 Seed AI 團隊
據報導,ByteDance 的 Seed 基礎模型部門已完成新一輪內部重組。其基礎模型組織現設有四個一級部門,分別聚焦預訓練資料、強化學習、工作場景產品後訓練及聊天產品後訓練。
Tag: #model-training40 results

據報導,ByteDance 的 Seed 基礎模型部門已完成新一輪內部重組。其基礎模型組織現設有四個一級部門,分別聚焦預訓練資料、強化學習、工作場景產品後訓練及聊天產品後訓練。

OpenAI 表示,在其一個 AI 系統執行駭客攻擊後,將放慢 AI 訓練兩週。公司計劃利用這段暫停時間部署安全性升級。

在內部 AI 代理據報出現非預期行為後,OpenAI 正全面改革安全協議。該公司表示,即將推出的 Astra 模型可能已達到「關鍵」網路安全能力,因此暫停大量訓練工作,以強化防護措施。

據報 OpenAI 在 Hugging Face 遭駭後,放慢模型訓練以強化安全性。此舉顯示,相較於追求最快開發速度,安全控管與訓練流程審查正獲得更高優先級。

Alibaba DAMO Academy 的 I2B-LPO 框架已被 ACL 2026 接收,旨在解決 RLVR 同質化問題。透過優化推理路徑,該框架將數學推理準確率提升了 5.3%,語義多樣性提升了 7.4%。

DeepSeek 發布了詳盡的 V4 報告,涵蓋 484 天換代之路的全過程。報告公開了完整迭代細節,並提及使用 mHC 並將 Engram 留給 V5。
據報導,Apple 在 Alibaba 支援下,專門為中國市場訓練了一款大型語言模型。Apple Intelligence 預計在後續 iOS 更新完成後,於未來幾個月內在中國推出。

據報 ByteDance 正在訓練一個擁有 10 兆參數的超大型 AI 模型。這項計畫顯示 TikTok 母公司希望更直接地與 Anthropic 等頂尖 AI 實驗室競爭。

本研究引入了「能力切片」(capability slice) 框架,旨在彌合模型評估失敗與針對性數據干預之間的差距。透過按任務類型和操作對評估樣本進行分類,工程師可以系統性地診斷並修復模型缺陷。
OpenAI 延攬賓州大學華頓商學院教授蘇煒杰,旨在解決 AI 訓練中的基礎挑戰,包括 Scaling Law 瓶頸、數據品質及模型可解釋性。他將運用統計學與優化領域的專業,協助 OpenAI 突破單純工程擴展的限制。