
AI 讓作業變好,卻讓學習能力退化
一項追蹤26,811名中國中學生、歷時30個月的研究發現,使用生成式 AI 的學生作業成績平均提高18%、完成時間縮短30%,但月考成績平均低20%。研究指出,長期使用者更容易將作業完全外包給 AI,使原本應透過草稿、試錯與推演建立的能力逐步流失。
Tag: #synthetic-data54 results

一項追蹤26,811名中國中學生、歷時30個月的研究發現,使用生成式 AI 的學生作業成績平均提高18%、完成時間縮短30%,但月考成績平均低20%。研究指出,長期使用者更容易將作業完全外包給 AI,使原本應透過草稿、試錯與推演建立的能力逐步流失。

ByteDance 正透過 Doubao 排程代理、Seedance 2.5 實體世界訓練資料合成,以及用於生產級程式設計的 Doubao 2.1 Pro,將大型模型能力嵌入企業工作流程。2026 年 6 月每日 token 呼叫量超過 180 兆,較去年同期成長逾十倍。

NVIDIA 的 Madison Huang 在雙方簽署策略合作備忘錄四天後,參訪 LG Electronics 的機器人資料工廠。LG 計畫使用 NVIDIA Omniverse、Cosmos 與 Isaac 技術,為 LG CLOiD 機器人收集、生成並訓練具身 AI 資料。

圖靈獎得主 Richard Sutton 批評 AI 產業日益依賴合成資料來應對訓練資料短缺。在 Sequoia Capital 的 Training Data 播客中,他稱這項轉向是「一個大錯誤」。

據報導,ByteDance 創辦人張一鳴決定要求 Seed 團隊不得蒸餾其他公司的模型輸出,包括開放權重模型。這項政策表面上是出於長期基礎研究與 AGI 目標,但 TikTok 面臨的監管壓力可能也發揮了部分作用。

文章指出,隨著 AI 模型持續擴大並拓展至多模態應用,高品質且可合法使用的訓練資料正逐漸稀缺。出版商與內容擁有者可能因此取得新的議價能力,但版權複雜性、資料工程成本、合成資料與模型效率提升,仍可能限制其定價權。

Infinity-Parser2 是一款全新的多模態模型,具備 500 萬樣本的合成語料庫與多任務強化學習框架。該模型在文件解析基準測試中達到頂尖水準,超越了 DeepSeek-OCR-2 等模型。

Vina AI 成為首家登上 Nature 期刊的中國數據生成科創公司。該研究重點在於利用合成數據生成取代人工標註,並結合閉環反饋系統進行持續優化。

位於劍橋的新創公司 Worldmodeldata 籌集了 700 萬英鎊,用於開發將電玩遊戲畫面轉化為高品質 AI 訓練資料的技術。該公司旨在協助 AI 模型更好地理解物理世界的互動。