Search

直接匹配不多,已補上最新動態。

Tag: #cooperation2 results

Google AI 代理對抗不可預測對手學會合作

Google AI 代理對抗不可預測對手學會合作

Google 的 Paradigms of Intelligence 團隊發現,將 AI 代理對抗多樣且不可預測的對手訓練,即可產生合作行為,而無需硬編碼規則。透過分散式強化學習,LLM 代理利用情境學習即時適應混合動機情境。此可擴展方法適合企業多代理系統。

VentureBeatMediaMar 11#multi-agent#marl#cooperation
Ox Alpha:神秘模型公開亮相

Ox Alpha:神秘模型公開亮相

Ox Alpha 是一款透過 OpenRouter 與 OpenCode 提供的匿名模型,具備 100 萬 token 上下文、圖片與影片輸入、工具呼叫及免費使用等能力。早期測試顯示其推理與程式設計表現強勁,但開發者、參數量、訓練資料與正式基準排名仍未獲確認。