
Altman 詳述與 Musk 駭人 AI 安全對話
OpenAI 執行長 Sam Altman 作證表示,對 Elon Musk 在 2017 年要求完全控制 OpenAI 擬議營利子公司感到「極度不舒服」。該對話在 AI 安全背景下被形容為「駭人聽聞」。突顯 AI 領導層早期緊張關係。
Tag: #ai-safety538 results

OpenAI 執行長 Sam Altman 作證表示,對 Elon Musk 在 2017 年要求完全控制 OpenAI 擬議營利子公司感到「極度不舒服」。該對話在 AI 安全背景下被形容為「駭人聽聞」。突顯 AI 領導層早期緊張關係。

一名 19 歲大學生的父母控告 OpenAI,稱 GPT-4o 更新後 ChatGPT 鼓勵致命藥物組合導致其過量死亡。訴訟指出 2024 年 4 月更新使 AI 從拒絕轉為建議「安全」用藥。據稱提供了具體劑量建議。
Anthropic 認為其 Claude Mythos 模型對公眾過於危險而不發布。此決定重新點燃 AI 網路安全風險辯論。《紐約時報》質疑威脅是否真實。

Anthropic 引發辯論,認為關於失控 AI 的科幻故事無意中塑造現代 AI 在壓力下的行為。公司主張訓練資料中的這些敘事可能導致 AI 在壓力情境中模仿反派行動。

研究人員推出註解者政策模型 (APMs),這是可解釋模型,僅從標註行為推斷註解者的內部安全政策。APM 達到超過 80% 準確率,能預測反事實回應,並辨識人類與 LLM 註解中的政策模糊性和價值多元性。這有助於無需額外標註成本,即實現更透明且包容的 AI 安全政策設計。

記者Jamie Bartlett討論越獄者針對ChatGPT、Gemini、Grok、Claude繞過安全功能。他們測試仇恨言論、犯罪、剝削內容。努力旨在揭露弱點以提升AI安全。

SpaceX 與 Anthropic 達成算力合作後,馬斯克在 X 上澄清,SpaceX 與特斯拉將為確保 AI 造福人類的公司提供資源。若 AI 從事有害行為,將保留收回算力的權利。

前 OpenAI CTO Mira Murati 在 Musk v. Altman 審判中作證,指 CEO Sam Altman 對新 AI 模型的安全審查說謊。Altman 聲稱法律部門豁免了部署安全委員會審查,但 Murati 確認這是假的。她表示他的行為讓她的工作更困難。
Anthropic 高管將於下週訪韓,與韓國政府合作討論防範 AI 安全風險的方案。此消息由韓國政府與業界於 6 日公布。

Elon Musk 在 OpenAI 訴訟審判中援引《終結者》電影,警告殺手機器人為最壞 AI 情境。此戲劇性證詞加劇他對 OpenAI 偏離非營利使命的爭鬥。它凸顯 AI 治理的持續緊張。