
DeepMind 駁斥「越多智能體越好」
DeepMind 論文評估 180 種智能體配置及 5 種架構,揭示擴展極限:智能體過多若不匹配任務則損性能。在 Finance-Agent、網頁導航等基準測試 GPT/Gemini/Claude。提出智能體系統量化原則。
Tag: #scaling-laws37 results

DeepMind 論文評估 180 種智能體配置及 5 種架構,揭示擴展極限:智能體過多若不匹配任務則損性能。在 Finance-Agent、網頁導航等基準測試 GPT/Gemini/Claude。提出智能體系統量化原則。

本研究提出了「能力收斂假說」(CCH),主張模型能力取決於特定的架構存取結構,而非僅僅是規模擴展。研究指出三種限制效能的「資源牆」,並證明結合壓縮狀態與逐字索引通道的混合架構能有效突破這些限制。
據報導,MiniMax 正在開發代號為 M3 Pro 的新一代大型語言模型,參數規模達 2.7 兆。該模型旨在提升複雜推理與多步驟任務的處理能力,超越其前代產品。

ByteDance 的研究人員發現了一項新的縮放定律,顯示 AI Agent 的學習速度每三個月即可翻倍。這項發現為傳統模型縮放面臨瓶頸時,提供了一條延續 AI 進步的潛在路徑。

ByteDance 旗下的 Doubao AI 已達到每日 2 億活躍用戶,每日處理 180 兆 tokens。然而,隨著預計 2026 年運算成本將超過 2,000 億人民幣,公司正面臨巨大的財務壓力。

研究人員發現了跨不同神經網路的通用神經元「Rosetta Neurons」,並分析了其規模擴展行為。研究顯示,隨著模型規模增加,這些神經元變得更具單語義性與專業化,為高效數據篩選提供了新方法。

HiDream.ai 正式發布了擁有超過兩千億參數的圖像生成模型 HiDream-O1-Image-Pro。該公司正加速融資進程,以支持其邁向世界模型的發展目標。

魔芯科技兩個月內連獲近2億元融資,由華為哈勃、富瀚微、聯想及浙創投投資。他們發布KOKONI-World原型,支持即時1080p互動視頻,並有CVPR2026論文揭示4D世界模型的Scaling Law。其純隱式空間表示實現幾何與物理理解的線性擴展。

Galbot,中國估值超過28億美元的最高未上市具身AI公司,推出LDA-1B,一個16億參數的世界-動作模型,統一世界與動作學習。它展示異質數據的擴展行為。模型與框架已開源,並獲RSS 2026接受。

威斯康星大學麥迪遜分校與史丹佛大學研究人員推出 Train-to-Test (T2) 縮放法,共同優化模型參數、訓練資料與推理樣本。建議訓練比 Chinchilla 規定小得多但資料量大得多的模型,將節省運算用於多重測試時樣本。此法提升複雜任務效能,同時控制企業應用推理成本。