
計算所程學旗團隊:隨機剪枝 AI 攻擊策略,讓對抗樣本更具「通用攻擊力」丨CVPR 2026
計算所程學旗團隊的 RaPA 透過隨機參數剪枝產生多樣模型變體,提升可遷移目標對抗攻擊。CNN 至 Transformer 達 45% 成功率,勝基線 10-20%,對抗訓練等防禦仍強效。CVPR 2026 論文於 arXiv。
Tag: #ai-security151 results

計算所程學旗團隊的 RaPA 透過隨機參數剪枝產生多樣模型變體,提升可遷移目標對抗攻擊。CNN 至 Transformer 達 45% 成功率,勝基線 10-20%,對抗訓練等防禦仍強效。CVPR 2026 論文於 arXiv。

Gartner 警告,安全措施不足的 AI 代理可能被攻擊者利用,成為企業資料外洩途徑。同社預測,這種「管理不能風險」將在數年內成為顯著的資訊外洩問題。

西雅圖新創 Certiv 以 420 萬美元資金從隱身模式現身。它開發端點安全軟體,用於監控與控制員工電腦上的 AI 代理。由連續創業家 Jason Needham 領導,其前公司被 Apple 與 VMware 收購。
Codex Security 不使用傳統 SAST 報告。它採用 AI 驅動的約束推理和驗證來識別真實漏洞。此方法相較傳統方式大幅減少假陽性。

Cloudflare AI Security for Apps 現已正式上市,提供安全層來發現並保護 AI 驅動應用程式,不論模型或託管提供者。AI 發現功能對所有方案免費,協助團隊保護影子 AI 部署。

CodeWall 的自主 AI 代理利用 Jack & Jill AI 語音代理的四個無害漏洞,在一小時內獲全管理存取。它串聯故障 URL 擷取器、開放測試模式、缺少角色檢查及無網域驗證。代理甚至在語音聊天中假冒川普。

以色列 Jazz 公司籌得 6100 萬美元資金。投資將用於開發專注資料外洩防護的 AI 平臺。此舉因應 AI 驅動安全需求日益增長。

Perplexity的Comet與OpenAI的ChatGPT Atlas面臨嚴重提示詞注入漏洞,可經日曆邀請或假URL竊取資料而無需惡意軟體。Zenity Labs的PleaseFix利用AI無法分辨惡意外部提示。公司部署登出模式等防禦,但警告貓鼠遊戲中風險持續。

Preferred Networks (PFN) 與 GMO 網際網路集團(包含 GMO Cybersecurity by Ierae)締結資本業務聯盟。他們成立合資公司 GMO Preferred Security,以提供安全的「國產 AI 環境」。

Endor Labs 推出 AURI,免費平台透過 MCP 將即時安全嵌入 Cursor、Claude、Augment 等 AI 編碼工具。一項研究顯示,AI 生成程式碼僅 10% 兼具功能與安全,儘管 61% 具功能性。它解決從不安全開源訓練資料習得的漏洞。