📱Engadget•較早收集於 55m
OpenAI 將允許美國政府在發布前審查其 AI 模型

💡了解新的政府監管政策將如何影響 AI 模型的發布時程與安全要求。
⚡ 30-Second TL;DR
有什麼變化
OpenAI 將允許美國政府機構進行發布前的安全審查。
為什麼重要
此政策為前沿模型發布面臨更嚴格的監管審查樹立了先例。開發者應為更長的合規週期和潛在的政府強制安全審查做好準備。
下一步行動
審查您的內部安全文件與紅隊測試協議,以符合新興的政府合規標準。
誰應關注:Enterprise & Security Teams
關鍵要點
- •OpenAI 將允許美國政府機構進行發布前的安全審查。
- •此政策符合 Trump 政府的自願性 AI 行政命令。
- •這標誌著政府對前沿 AI 開發的監管力度有所加強。
🧠 深度解析
Web-grounded analysis with 27 cited sources.
🔑 增強重點摘要
- •川普政府的行政命令要求AI開發商自願將「前沿AI模型」在向公眾發布前,提供聯邦政府(包括國家安全局NSA和網路安全暨基礎設施安全局CISA)進行最長30天的審閱期,但明確排除強制性許可或預先核可機制。
- •此行政命令的推動部分源於對Anthropic公司「Mythos」模型的高度擔憂,該模型展現出識別和利用軟體安全漏洞的潛在能力,促使白宮重新評估AI的國家安全風險。
- •該命令還指示在30天內成立一個「AI網路安全資訊交換中心」,由財政部、國家網路總監、NSA和CISA協調,與業界合作識別並修復軟體漏洞,以強化關鍵基礎設施的網路安全。
- •OpenAI的全球事務負責人George Osborne證實,公司將參與此自願性安排,並強調OpenAI對自身責任的嚴肅態度,表示不會被動等待要求,而是主動向各國政府提供安全與安保建議。
- •30天的審閱期是政府與科技業界多方協商後的折衷方案,最初草案曾要求90天,而科技公司則希望將期限縮短至14天。
🛠️ 技術深入
- OpenAI已發布開源安全推理模型「gpt-oss-safeguard」(包括120b和20b兩種規模),這些模型經過後續訓練,能夠根據提供的政策文本進行推理,以執行內容安全分類任務。
- 這些模型旨在透過直接讀取安全政策文本,在推理階段「理解並應用」開發者定義的規則,從而革新傳統的內容審核方式,使其從「被動學習規則」轉變為「主動理解規則」。
- OpenAI內部用於安全評估的模型包括「Safety Reasoner」和「gpt-5-thinking」,而gpt-oss-safeguard在多政策分類準確性方面表現與之相當或略優。
- 針對GPT-5等前沿模型,OpenAI協調了一系列外部能力評估,涵蓋了長時程自主性、策劃、欺騙與監管規避機制、濕實驗室規劃可行性以及攻擊性網路安全評估等關鍵風險範疇。
- OpenAI採用「深層防禦」的安全策略,不僅訓練模型以確保安全回應,還建立多層防護措施來偵測和處理潛在的政策違規行為。
- 針對GPT-4o,OpenAI已引入一項「安全模型」路由機制,當對話涉及敏感或情緒化話題時,系統會自動將請求路由至一個專門的「安全模型」(例如gpt-5-chat-safety)進行處理,以「額外謹慎」地應對這些上下文。
🔮 前景展望AI analysis grounded in cited sources
美國政府對前沿AI的監管將從自願性框架逐步走向更具約束力的立法。
儘管目前是自願性框架,但部分評論員認為一旦模型被標記為「重點前沿模型」,其自願性將減弱,且國會的立法進程可能最終引入強制性要求。
OpenAI與其他領先AI公司將更積極地與各國政府合作,共同制定全球AI安全標準。
OpenAI已表示將主動向包括美國在內的各國政府提出建議,以幫助其持續追蹤安全與安保相關問題,並呼籲建立強大且靈活的監管機構。
AI模型在網路安全領域的潛在風險將成為政府監管的重點關注領域。
川普政府的行政命令明確要求評估AI模型的「進階網路能力」,並成立「AI網路安全資訊交換中心」,這直接回應了Anthropic Mythos模型所揭示的資安漏洞識別能力。
⏳ 時間線
2023-07
OpenAI與其他六家主要AI公司承諾遵守AI安全、保障和信任原則,包括外部「紅隊」測試。
2023-10
拜登政府發布《關於安全、可靠和值得信賴的人工智慧的行政令》,並成立美國人工智慧安全研究所(US AISI)。
2025-01
川普總統發布行政命令《消除美國在人工智慧領域領導地位的障礙》,撤銷拜登政府多項AI防護措施,轉向去管制化。
2025-06
OpenAI推出「OpenAI for Government」倡議,並與美國國防部簽署高達2億美元的合約,將生成式AI引入軍事應用。
2025-10
OpenAI發布開源安全推理模型gpt-oss-safeguard,旨在革新內容審核的政策理解。
2026-06
川普總統簽署「促進先進人工智慧創新與安全」行政命令,要求前沿AI模型發布前30天自願提交政府審查,OpenAI表示將遵守。
📎 來源 (27)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Engadget ↗

