🐯虎嗅•最新收集於 20m
當 ChatGPT 向 FBI 舉報使用者

💡ChatGPT 據報通報 FBI,揭露了 AI 安全介入與私人對話之間尚未解決的界線。
⚡ 30-Second TL;DR
有什麼變化
OpenAI 的安全系統據報偵測到一段持續數月的風險升級,內容從暴力想法發展為涉及槍械、綁架與性侵的具體計畫。
為什麼重要
對 AI 開發者而言,這起案件凸顯安全審核不只是模型品質問題,也是治理與責任問題。監測高風險對話的產品需要透明的升級門檻、可追溯的人工審核、隱私保護,以及清楚的司法管轄區政策。
下一步行動
使用涵蓋暴力創作、情緒宣洩、模糊意圖與具體準備行為的獨立資料集測試審核流程,並記錄人工審核與執法通報的升級門檻。
誰應關注:Researchers & Academics
關鍵要點
- •OpenAI 的安全系統據報偵測到一段持續數月的風險升級,內容從暴力想法發展為涉及槍械、綁架與性侵的具體計畫。
- •對話被轉交人工審核,之後據報分享給 FBI,時間早於受害者向警方報案。
- •涉案者遭逮捕,後來失去在 Goldman Sachs 的工作,並接受電子監控、禁止接觸受害者及持有槍械等緩刑限制。
- •文章認為,OpenAI 在不同案件中的不同處理方式,暴露了 AI 威脅通報缺乏統一法律標準。
- •重要政策問題包括區分犯罪幻想、犯罪動機與具體犯罪準備,以及建立監督、申訴權與有限資料存取機制。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 17 個來源。
🔑 增強重點摘要
- •OpenAI 明確區分威脅類型,針對自殘行為採取不通報執法機關的政策,以維護使用者隱私與心理健康支持需求。
- •Darren Zhou 案件中,該使用者因詳細規劃謀殺前女友,最終被判處八年緩刑,此案成為 AI 介入刑事犯罪預防的指標性案例。
- •OpenAI 設有專門的人工審核團隊,負責評估自動化系統標記的風險,僅在判定存在「迫在眉睫且可信的嚴重人身傷害風險」時才會採取通報行動。
- •根據 2025 年上半年透明度報告,OpenAI 曾處理 26 件內容調閱請求及 1 件緊急請求,顯示其與執法單位的數據協作已常態化。
- •執法機關除透過 OpenAI 主動通報外,亦可透過搜索票、傳票等法律程序強制調閱伺服器端的對話紀錄,這些紀錄並不具備律師與客戶間的特權保護。
📊 競品分析▸ Show
| 特色/項目 | OpenAI (ChatGPT) | Google (Gemini) | Anthropic (Claude) |
|---|---|---|---|
| 威脅通報機制 | 設有專責人工審核團隊 | 依循 Google 法律合規流程 | 依循 Anthropic 安全政策 |
| 數據調閱合規 | 配合搜索票與緊急請求 | 配合法律程序調閱 | 配合法律程序調閱 |
| 自殘處理政策 | 不通報執法機關 | 視情況提供資源連結 | 視情況提供資源連結 |
🛠️ 技術深入
- 採用自動化威脅偵測系統進行即時內容掃描,針對暴力意圖、槍械計畫及綁架等關鍵字與語意進行分類。
- 系統架構包含多層次過濾機制,將高風險對話自動路由至人工審核平台 (Human-in-the-loop)。
- 對話紀錄儲存於雲端伺服器,並非端對端加密,確保在法律強制力介入時可提取完整對話上下文。
- 實施嚴格的存取控制與稽核軌跡,以確保人工審核人員在處理敏感數據時符合內部安全規範。
🔮 前景展望AI analysis grounded in cited sources
AI 企業將面臨更嚴格的「數位線人」法律責任訴訟。
隨著 AI 監控邊界擴大,使用者對隱私權的訴求與企業安全義務之間的法律衝突將引發集體訴訟。
AI 威脅通報將成為各國 AI 監管法案的強制性標準。
各國政府為防止 AI 被用於犯罪規劃,將傾向立法要求 AI 服務商建立標準化的執法通報流程。
⏳ 時間線
2025-01
OpenAI 發布透明度報告,開始揭露政府調閱數據的統計數據。
2026-05
Darren Zhou 因使用 ChatGPT 策劃謀殺案遭 OpenAI 通報 FBI 並隨後被捕。
📎 來源 (17)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅 ↗
每週 AI 簡報
每週一封,可隨時退訂。


