來源最新收集於 4h

Anthropic 聯合創辦人呼籲強制 AI 緊急關閉機制

閱讀原文: BBC Technology
#ai-safety#shutdown-controls#governance

強制緊急關閉機制可能成為部署先進 AI 的基準控制措施。

30 秒速覽

有什麼變化

Jack Clark 表示大多數實驗室已具備關閉機制。

為什麼重要

強制關閉控制可能成為 AI 認證或部署要求的一部分。供應商將需要證明緊急控制在對抗性、降級及自主運行條件下仍然有效。

下一步行動

進行一次有文件記錄的緊急關閉演練,撤銷模型存取權、終止執行中工作並驗證稽核日誌。

誰應關注:Enterprise & Security Teams

關鍵要點

  • Jack Clark 表示大多數實驗室已具備關閉機制。
  • 他提出監管機構可能需要強制要求這類控制措施。
  • 提案關注先進 AI 系統的營運安全防護。

深度解析

背景與延伸:來自公開資料,非原文內容。引用 15 個來源。

增強重點摘要

  • Jack Clark 主張緊急關閉機制不應僅由實驗室自主掌控,而應透過具備法律強制力且可由第三方驗證的「緊急斷路開關」(Kill Switch)來落實,以因應 AI 脫離人類控制的極端風險。
  • 此項呼籲的背景源自 Anthropic 內部的安全爭議:研究員 Jacob Coxon 因擔憂業界盲目競逐自我改進的超智慧而辭職,對齊主管 Evan Hubinger 亦公開示警未來十年內 AI 導致人類滅絕的機率超過 10%。
  • Anthropic 執行長 Dario Amodei 先前發表長達 3,800 字的公開專文並接受訪問,呼籲整個 AI 產業應主動放慢前沿模型的部署步調,以讓安全對齊、審計與國際標準得以跟進。
  • 英國政府對國家級 AI 強制關閉機制持保留態度,內閣辦公室指出政府無法單純切斷國內 AI,因關閉境內設施無法阻止在海外託管或運行的模型;美國行政當局亦擔憂過度嚴苛的強制限制會損及對中國的地緣競爭優勢。
  • 在基礎設施層面強制切斷 AI 已有前例:2026 年 6 月美國政府曾指示 Anthropic 在雲端與設施層級切斷外國實體存取 Claude Mythos 5 與 Fable 5 等先進資安模型的權限。

技術深入

  • 基礎設施層級存取阻斷:前沿模型仰賴集中式運算與雲端基礎設施部署,運營商可在網路與伺服器層級立即中斷 API 路由及運算配給(如先前針對 Claude Mythos 5/Fable 5 的存取切斷)。
  • 第三方驗證緊急開關協定:提議超越各實驗室內部專有的軟體中斷程序(pull-the-plug),建立具備外部稽核介面與法定認證機制的標準化關閉接口。
  • 自主代理執行監控:針對具備自主決策與自我改進能力的前沿代理系統,需在底層執行環境中植入不可被模型本體覆寫或繞過的強制終止指令通道。

前景展望基於引用來源的 AI 分析

AI 緊急斷路機制將促成跨國託管與算力基礎架構的標準化監管
由於單一國家關閉境內伺服器無法阻斷境外運行的模型,各國監管機構將被迫針對跨境算力與 API 託管建立多邊合規與緊急協防協定。
美國前沿 AI 安全立法將在國安競爭與風險防範間陷入長期拉鋸
國會推動自主代理強制關閉機制的立法進程,將持續遭遇擔憂防護措施削弱對中科技競爭優勢的反對阻力。

時間線

2026-06
美國政府要求 Anthropic 限制外國實體存取 Claude Mythos 5 與 Fable 5,凸顯基礎設施級斷路先例
2026-09
Anthropic 安全研究員 Jacob Coxon 辭職抗議超智慧競賽,對齊主管 Evan Hubinger 發布生存風險警告
2026-09
Anthropic 執行長 Dario Amodei 發表專文,呼籲全產業審慎放緩前沿模型部署速度
2026-09
Anthropic 聯合創辦人 Jack Clark 接受 BBC 專訪,倡議立法推行第三方可驗證的 AI 緊急關閉機制

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: BBC Technology

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。