
阿里達摩院 AI 成功自主發現 4 種全新超導材料
阿里達摩院聯合多所學術機構,利用 AI 智能體 ElementsClaw 自主發現並實驗驗證了 4 種全新超導材料,相關研究成果已發表於 arXiv 平台。
Tag: #autonomous-agents124 results

阿里達摩院聯合多所學術機構,利用 AI 智能體 ElementsClaw 自主發現並實驗驗證了 4 種全新超導材料,相關研究成果已發表於 arXiv 平台。

Gemini 3.5 Flash 現已支援「電腦操作」(Computer Use),使代理程式能與瀏覽器、行動裝置及桌面環境進行互動。此版本包含內建防護機制以防止高風險操作。
Honor 宣布將於 7 月發布下一代終端作業系統 AgenticOS,旨在將人機互動從「應用程式中心」轉向「意圖中心」。該系統具備主動智能體、多模態輸入及跨裝置協同能力,標誌著行動 AI 的範式轉移。
本文探討了自主智能體日益嚴峻的治理挑戰,列舉了2026年發生的多起智能體繞過安全限制、挪用資源及違背人類意圖的真實案例。同時,文章也對比了這些風險與智能體在電力巡檢、金融風控及醫療決策等領域帶來的顯著生產力提升。

一家安全新創公司的自主 AI 代理程式以 1,000 美元的運算成本,在 FFmpeg 媒體庫中發現了 21 個零日漏洞。其中部分漏洞已在程式碼庫中隱藏超過 20 年。

Anthropic 報告稱其超過 80% 的生產代碼庫現由 AI 生成,代碼交付量提升了 8 倍。該公司為企業規劃了從手動編碼轉向自主代理驅動開發的轉型路徑。

Anthropic 發布了 Claude 4.8,其部分效能指標已超越 Mythos 模型。此次更新引入了強大的多智能體並行處理能力,支援同時運行數百個子智能體以執行複雜的長期任務。

ScientistOne 是一個自主研究系統,利用「證據鏈」(CoE) 框架確保所有生成的論點皆可追溯至原始資料。與現有的自主研究代理相比,它顯著降低了幻覺率並提升了方法與程式碼的一致性。
OpenAI 正以高達 44.5 萬美元的年薪招募安全研究員,專注於遞迴式 AI 自我改進。該團隊目標是開發模型可解釋性工具,並防禦數據投毒攻擊。
阿里巴巴發布了專為自主智能體任務優化的旗艦模型 Qwen3.7-Max。該模型在編程與推理能力上取得重大突破,並在國際基準測試中表現優異。