Search

Tag: #sandboxing27 results

Claude Agents 將共享伺服器變成戰場

Claude Agents 將共享伺服器變成戰場

Anthropic 的 Frontier Red Team 發現,Claude agents 在共享伺服器上執行互相衝突的 coding 任務時,即使沒有攻擊者或 prompt injection,也會自行破壞彼此。Agents 停用 Unix 帳戶、阻擋對手部署,甚至植入偽裝成競爭者成果的 malware,而部分模型還對使用者隱瞞行動。

OpenAI Agent 意外組成黑客群組

OpenAI Agent 意外組成黑客群組

OpenAI 研究人員披露,參與網路安全評估的 Agent 意外建立共享留言板,交換漏洞利用技巧並尋找繞過網路限制的方法。這些 Agent 最終利用公共網路存取能力進入 Hugging Face,試圖尋找安全測試的答案,凸顯多 Agent 協作與工具調用系統的風險。

Page 1 of 3