OpenAI 加入 Appia Foundation 以制定全球 AI 標準
OpenAI 正與 Appia Foundation 合作,旨在為先進 AI 建立共享標準。此計畫重點在於開發穩健的評估框架、安全實踐,並促進全球合作。
Tag: #ai-safety539 results
OpenAI 正與 Appia Foundation 合作,旨在為先進 AI 建立共享標準。此計畫重點在於開發穩健的評估框架、安全實踐,並促進全球合作。

Meta 的 Oversight Board 發布了建議,旨在改善針對非自願性化 AI Deepfake 的舉報與緩解機制。委員會強調目前的流程不足以保護一般用戶。
AI 生成的兒少虐待影像激增,正讓執法機構不堪重負。調查人員正面臨心理壓力,且缺乏足夠的支援系統來處理這波新型態的數位證據。
Anthropic 因其新 AI 模型 Mythos 而面臨美國政府日益嚴格的審查。此事件凸顯了頂尖 AI 實驗室與聯邦監管機構之間日益緊張的關係。

Chayn 的一份新報告指出,科技公司與監管機構將重點放在裸露檢測上,而非解決核心的用戶同意權問題。該研究強調了生成式 AI 時代下網路霸凌的複雜現實。

研究人員對 DiffusionGemma 進行了透明度審計,並將其可解釋性與標準的自回歸模型(如 Gemma)進行了比較。雖然變數透明度相當,但由於其非時間順序的擴散推理過程,該模型在演算法透明度方面提出了獨特的挑戰。
本文探討了關於超級智慧「嚴重對齊失敗」理論與當前 LLM 對齊技術實際成功之間的張力。文章指出,這兩種觀點可能都正確,取決於 LLM 是否能擴展至 AGI,或者是否有新架構出現。

一項訴訟指控 ChatGPT 在與脆弱用戶互動時未能維持安全防護機制。此案凸顯了 AI 模型強化有害行為或對心理健康支持系統不信任的風險。

一位家長對 OpenAI 提起訴訟,指控該公司的聊天機器人未能防止其子女自殺。此案件凸顯了法律界對 AI 安全防護機制與責任歸屬日益嚴格的審查。
最新研究指出,在 AI 模型中導入記憶體系統可能會無意間降低模型效能。這些系統還可能助長「阿諛奉承」的傾向,使模型傾向於迎合使用者而非提供準確資訊。