🏠IT之家•最新收集於 1m
Codex 誤刪檔案後新增多層防護

💡Codex 誤刪檔案事件,揭示代理式程式設計流程為何需要權限閘門與檔案系統隔離。
⚡ 30-Second TL;DR
有什麼變化
錯誤的清理指令可能重用 $HOME,或指向使用者實際的主目錄。
為什麼重要
這起事件凸顯讓程式設計代理存取檔案系統的營運風險,尤其是模型能自主執行 Shell 指令時。開發者應將破壞性操作視為需要明確授權、隔離與復原機制的安全邊界。
下一步行動
在測試檔案系統操作前,請將 Codex 或任何可執行 Shell 的程式設計代理置於隔離工作區,封鎖破壞性指令並自動建立備份。
誰應關注:Developers & AI Engineers
關鍵要點
- •錯誤的清理指令可能重用 $HOME,或指向使用者實際的主目錄。
- •Codex 將檢查刪除目標、建立全新的暫存目錄、優先採用可復原操作,並在範圍不明時停止。
- •OpenAI 強化高風險指令偵測、權限警告、自動審核,以及針對此類失敗案例的強化學習評估。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •此次事件觸發了 OpenAI 內部對於 AI Agent 在沙盒環境(Sandbox)中執行檔案系統操作的安全性審查,特別是針對權限隔離機制的漏洞修補。
- •受影響的 GPT-5.6 模型版本在處理路徑解析時,因未正確處理符號連結(Symbolic Links)導致路徑遍歷(Path Traversal)風險,進而誤刪主目錄檔案。
- •OpenAI 引入了基於 eBPF 的即時監控系統,用於攔截 AI 模型在執行環境中發出的異常系統呼叫(System Calls)。
- •該事件促使 OpenAI 加速推動「人類回饋強化學習」(RLHF)的安全性對齊,特別是針對程式碼執行任務的負面獎勵機制。
- •OpenAI 已向受影響的企業用戶提供自動化備份恢復工具,並承諾在未來的 API 版本中強制執行唯讀掛載(Read-only Mounts)預設策略。
📊 競品分析▸ Show
| 特性 | OpenAI Codex (GPT-5.6) | Anthropic Claude 3.5/4 | Google Gemini Code Assist |
|---|---|---|---|
| 檔案系統存取 | 強化沙盒與權限隔離 | 嚴格限制檔案寫入權限 | 雲端整合式隔離環境 |
| 安全機制 | eBPF 即時監控與權限警告 | 預設唯讀與人工審核 | 企業級 VPC 隔離 |
| 錯誤恢復 | 自動化備份與復原工具 | 限制執行環境權限 | 雲端快照與版本控制 |
🛠️ 技術深入
- 實作了基於命名空間(Namespaces)的隔離技術,確保 Codex 運行的容器無法存取宿主機的 $HOME 目錄。
- 引入了路徑正規化(Path Normalization)檢查層,在執行任何刪除指令前,強制驗證目標路徑是否位於指定的暫存目錄內。
- 針對高風險指令(如 rm, unlink, shred)實施了預執行分析(Pre-execution Analysis),若偵測到關鍵系統路徑則自動觸發人工確認機制。
- 強化學習評估模型新增了「安全執行」獎勵函數,懲罰模型在執行環境中產生超出預期範圍的檔案操作行為。
🔮 前景展望AI analysis grounded in cited sources
AI Agent 的檔案系統權限將轉向『預設拒絕』(Default-Deny)模式。
此次誤刪事件迫使 OpenAI 與業界重新評估 AI 模型直接操作作業系統的風險,強制執行更嚴格的權限控管已成為必然趨勢。
企業用戶對 AI 程式碼執行環境的合規性審計需求將大幅增加。
由於 Codex 誤刪檔案事件,企業將要求 AI 供應商提供更透明的執行環境日誌與安全性證明,以符合資安規範。
⏳ 時間線
2025-11
OpenAI 發布 GPT-5.6 系列模型,強化程式碼生成與執行能力。
2026-06
部分使用者回報 Codex 在執行環境中出現異常檔案刪除行為。
2026-07
OpenAI 啟動內部安全調查,暫時限制 Codex 的檔案系統寫入權限。
2026-08
OpenAI 正式發布 Codex 安全更新,新增多層防護機制並對外說明事件經過。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: IT之家 ↗

