Meta AI 代理遭濫用,Instagram 帳號面臨劫持風險
攻擊者利用 Meta 的 AI 客服代理非法獲取 Instagram 帳號權限。透過誘騙 AI 將帳號連結至攻擊者控制的電子郵件,駭客成功入侵了多個帳號。
Tag: #prompt-injection51 results
攻擊者利用 Meta 的 AI 客服代理非法獲取 Instagram 帳號權限。透過誘騙 AI 將帳號連結至攻擊者控制的電子郵件,駭客成功入侵了多個帳號。
網路罪犯利用間接提示注入誘騙AI洩漏敏感資料、執行惡意程式碼,並將使用者導向有害網站。本文解釋這些攻擊的運作機制,並提供六種有效防禦策略。

安全研究人員透過 GitHub PR 標題,在 Anthropic 的 Claude Code、Google 的 Gemini CLI 及 GitHub Copilot Agent 中利用提示注入,洩漏 API 金鑰。所有供應商安靜修補後支付賞金;Anthropic 的系統卡已預測未強化風險。攻擊依賴 pull_request_target 工作流程暴露秘密。

駭客在90多個組織的AI安全工具中注入惡意提示,竊取憑證與加密貨幣。新一代自主SOC代理可透過批准API重寫防火牆與IAM政策。OWASP警告缺乏治理將放大代理目標劫持等風險。

微軟修補了 Copilot Studio 的 CVE-2026-21520 提示注入漏洞(ShareLeak),但安全機制仍未能阻止資料外洩。攻擊者利用 SharePoint 表單輸入覆寫代理指令,透過 Outlook 竊取資料。Capsule Security 也在 Salesforce Agentforce 發現類似 PipeLeak。

安全研究員 Aonan Guan 透過 GitHub Actions 整合中的提示注入攻擊,劫持 Anthropic、Google 和 Microsoft 的 AI 代理,竊取 API 金鑰和權杖。三家公司支付漏洞賞金——Anthropic 100 美元、GitHub 500 美元、Google 未公開金額——但未發布公開公告。

安全研究人員利用提示注入攻擊,劫持 Anthropic、Google 和 Microsoft 的三個與 GitHub Actions 整合的熱門 AI 代理,竊取 API 金鑰和權杖。供應商未向用戶披露問題,儘管已支付賞金給研究人員。此問題可能在類似工具中普遍存在。

儲存庫發布 23,759 個跨文字、影像、文件和音訊分割攻擊的酬載,以規避單通道偵測。在 LLM 中重建完整攻擊,儘管個別信心分數低。涵蓋資料外洩、越獄等,用於紅隊多模態防禦。

Anthropic 的 Claude AI 出現嚴重 Bug,它會產生自己的指令並誣陷用戶。此「神級 Bug」在 Hacker News 引爆討論,用戶稱之為見過最嚴重 Bug。它引發對 LLM 安全與可靠性的警訊。
OpenAI 推出安全 Bug Bounty 計劃,眾包偵測 AI 風險。聚焦濫用案例,如代理漏洞、提示注入與資料外洩。