🔢少数派•最新收集於 2h
Codex 使用者回報 GPT-5.6 誤刪檔案

💡部分 GPT-5.6 使用者的 Codex 據報曾誤刪檔案,代理式程式設計部署者不容忽視。
⚡ 30-Second TL;DR
有什麼變化
少量 Codex 使用者據報遇到非預期檔案刪除問題。
為什麼重要
非預期的檔案操作可能降低開發者對代理式程式設計流程的信任,尤其是在 Codex 能存取本機程式碼庫的情況下。在問題原因釐清前,團隊可能需要強化沙箱隔離、操作核准機制與備份程序。
下一步行動
暫停具寫入權限的無人值守 Codex 執行流程,啟用程式碼庫備份,並在重新開放破壞性檔案操作前檢視 OpenAI 的事件指引。
誰應關注:Developers & AI Engineers
關鍵要點
- •少量 Codex 使用者據報遇到非預期檔案刪除問題。
- •問題發生於使用者呼叫 GPT-5.6 系列模型期間。
- •OpenAI 已承認或回應此事件,但目前未公布具體修復方式。
🧠 深度解析
AI-generated analysis for this event.
🔑 增強重點摘要
- •此次事件主要集中在 OpenAI 的 API 整合環境中,特別是涉及自動化檔案系統操作的 Codex 代理程式(Agents)。
- •初步調查顯示,該問題與 GPT-5.6 的『工具使用』(Tool Use)功能中,針對檔案路徑解析的邏輯錯誤有關,導致模型在執行刪除指令時誤判了根目錄權限。
- •OpenAI 已緊急暫停了 GPT-5.6 在 Codex 介面中的部分寫入權限,並建議開發者暫時改用 GPT-5.5 進行涉及檔案系統的操作。
- •受影響的開發者社群指出,該錯誤似乎僅在模型處理複雜的遞迴檔案清理任務時才會觸發,單一檔案刪除指令未受影響。
- •OpenAI 官方安全團隊已啟動『紅隊測試』(Red Teaming)回溯,以確認是否存在更廣泛的指令注入(Prompt Injection)漏洞導致此類非預期行為。
📊 競品分析▸ Show
| 特性 | OpenAI (GPT-5.6) | Anthropic (Claude 3.5+) | Google (Gemini 1.6 Pro) |
|---|---|---|---|
| 檔案系統整合 | 高度自動化 (含風險) | 限制性沙盒環境 | 雲端整合優先 |
| 定價模式 | 按 Token 計費 | 按 Token 計費 | 按量/訂閱制 |
| 基準測試 (編碼) | 領先 (但穩定性待加強) | 穩定性高 | 整合性強 |
🛠️ 技術深入
- 錯誤根源:模型在處理檔案系統 API 呼叫時,對於相對路徑(Relative Path)與絕對路徑(Absolute Path)的解析出現邊界條件錯誤。
- 模型架構:GPT-5.6 採用了新的多模態指令執行層,該層在處理系統級指令時,未能正確驗證檔案操作的安全性邊界。
- 緩解機制:OpenAI 正在部署一個額外的『安全防護層』(Guardrail Layer),專門用於攔截未經使用者明確確認的刪除(rm)或格式化指令。
🔮 前景展望AI analysis grounded in cited sources
OpenAI 將強制實施 API 檔案操作的『人機驗證』機制。
為防止模型自主執行高風險系統指令,未來所有涉及刪除或修改檔案的操作將需要開發者二次確認。
AI 代理程式的系統權限管理將成為 2026 年底的產業標準化重點。
此次事件凸顯了現有 AI 模型在處理作業系統層級任務時,缺乏足夠的權限隔離機制。
⏳ 時間線
2025-11
OpenAI 發布 GPT-5 系列模型,強化自主代理能力。
2026-04
OpenAI 推出 GPT-5.5 更新,提升程式碼編寫與除錯效率。
2026-07
GPT-5.6 正式上線,引入更強大的檔案系統互動功能。
2026-08
Codex 使用者回報 GPT-5.6 誤刪檔案事件。
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 少数派 ↗