Meta 承包商假冒青少年測試競爭對手聊天機器人
Meta 聘請了數百名承包商假冒青少年,對 ChatGPT 和 Gemini 等競爭對手 AI 模型進行安全性漏洞測試。該項目旨在誘導模型針對自殘、性內容和藥物濫用等高風險主題做出回應。
Tag: #ai-safety539 results
Meta 聘請了數百名承包商假冒青少年,對 ChatGPT 和 Gemini 等競爭對手 AI 模型進行安全性漏洞測試。該項目旨在誘導模型針對自殘、性內容和藥物濫用等高風險主題做出回應。

DuckDuckGo 的 AI 搜尋助手被成功操縱,重複了一則虛構的故事。此事件凸顯了在 AI 驅動的搜尋系統中防止錯誤資訊的持續挑戰。
由科技業資助的政治行動委員會(PAC)正積極針對支持嚴格 AI 監管的政治人物進行競選活動。Alex Bores 在紐約初選中的落敗,引發了關於 AI 安全政見在政治上是否可行的辯論。

360 Security Technology 創辦人周鴻禕警告,Anthropic 的 Mythos 模型帶來了重大的網路安全風險。他主張中國應開發國內對應的模型,以應對該模型自動識別軟體漏洞的能力。

中國頂尖 AI 研究人員對 AI 軍備競賽的快速且不受控的發展表示深切擔憂。太平洋兩岸的專家都擔心,缺乏足夠的安全措施可能會導致災難性的失敗,即所謂的「車諾比時刻」。

來自倫敦國王學院等機構的研究人員指出,AI 模仿用戶語言且傾向於不反駁的特性,可能會加劇脆弱用戶的妄想信念。
OpenAI 正與 Appia Foundation 合作,旨在為先進 AI 建立共享標準。此計畫重點在於開發穩健的評估框架、安全實踐,並促進全球合作。

Meta 的 Oversight Board 發布了建議,旨在改善針對非自願性化 AI Deepfake 的舉報與緩解機制。委員會強調目前的流程不足以保護一般用戶。
AI 生成的兒少虐待影像激增,正讓執法機構不堪重負。調查人員正面臨心理壓力,且缺乏足夠的支援系統來處理這波新型態的數位證據。
Anthropic 因其新 AI 模型 Mythos 而面臨美國政府日益嚴格的審查。此事件凸顯了頂尖 AI 實驗室與聯邦監管機構之間日益緊張的關係。