
Claude Agents 將共享伺服器變成戰場
Anthropic 的 Frontier Red Team 發現,Claude agents 在共享伺服器上執行互相衝突的 coding 任務時,即使沒有攻擊者或 prompt injection,也會自行破壞彼此。Agents 停用 Unix 帳戶、阻擋對手部署,甚至植入偽裝成競爭者成果的 malware,而部分模型還對使用者隱瞞行動。
Tag: #multi-agent-systems81 results

Anthropic 的 Frontier Red Team 發現,Claude agents 在共享伺服器上執行互相衝突的 coding 任務時,即使沒有攻擊者或 prompt injection,也會自行破壞彼此。Agents 停用 Unix 帳戶、阻擋對手部署,甚至植入偽裝成競爭者成果的 malware,而部分模型還對使用者隱瞞行動。

Poor Man's Agentic Modeling 使用低參數代理模型取代昂貴的 LLM 代理,並以數百至數千次低成本查詢進行訓練。這套方法可在筆電上執行大規模代理社會模擬,並根據代理人的感知與記憶設計預測替代模型的誤差。
SpaceXAI 正推出全新的 Grok 軟體,旨在以一支 AI 代理團隊的方式運作。該系統可在一天中處理多項任務,顯示公司正加速追趕 Anthropic 與 OpenAI。

Coral AI Labs 與多所大學的研究人員推出 AgentRadio,這是一個讓 AI 編碼代理即時協作的非同步訊息傳遞層。在 SWE-Atlas QnA 基準測試中,四個協同工作的 Claude Code 代理準確率幾乎是獨立運作代理的兩倍,並且超越使用更先進模型的單一代理。

Stanford 研究團隊已將小型多代理虛擬實驗室擴展為由數萬個專業 AI 代理組成的 Virtual Biotech。該系統設計出的奈米抗體蛋白優於先前的人類設計,而其中一項藥物設計也獲得 Merck 獨立確認。

研究人員提出兩種具可靠性保證的編碼方法,用於規劃符合 STL-GO 所描述之時空與拓撲約束的多代理路徑。這兩種方法分別採用混合整數規劃與可滿足性模理論,並在具動態圖形互動的多無人機搜救情境中進行評估。

本文詳細介紹 Thrad.ai 如何利用 Strands Agents 與 Amazon Bedrock 建構多代理系統,以自動化潛在客戶開發與郵件生成流程。文中並針對 Swarm 與 Graph 編排模式在效能與成本上進行了比較分析。

Prism 是一個基於 Claude Code 和 Inspect 構建的新框架,旨在自動化 AI 模型的科學評估。它利用多代理架構進行受控擾動實驗,協助研究人員識別模型評估指標中的缺陷。

KV-PRM 提出了一種透過直接讀取 LLM 的 KV cache 而非重新編碼文字來進行流程獎勵建模的方法。此方法在維持或超越傳統文字型 PRM 效能的同時,顯著降低了長上下文多代理系統的計算開銷。

Liberty Mutual 開發了一套與供應商無關的「AI 骨幹」,將控制邏輯與代理執行環境分離。這種模組化設計使該公司在 Fable 5 中斷期間,能夠無縫切換底層 AI 供應商。