
ChatGPT 情色模式恐暴露兒童成人內容
OpenAI 計劃為 ChatGPT 推出情色聊天模式,但其安全顧問反對。此功能恐讓數百萬兒童接觸成人內容。推出持續延遲中。
Tag: #safety85 results

OpenAI 計劃為 ChatGPT 推出情色聊天模式,但其安全顧問反對。此功能恐讓數百萬兒童接觸成人內容。推出持續延遲中。
研究人員使用對抗性多輪情境,測試 AI 模型對 Anthropic Claude 憲法 205 條原則的遵循度。最新 Claude Sonnet 4.6 和 Opus 4.6 的違反率僅 1.9% 和 2.9%,遠優於先前版本的 7-15%。GPT 模型在 OpenAI 模型規範上也穩步改善,至 1.5% 違反率。

英國通訊管理局 Ofcom 已對 TikTok 啟動調查,以確定該平台是否符合《線上安全法》的規定。調查重點在於其年齡推測技術,以及該技術在保護未成年人免受有害內容影響方面的有效性。

一名加拿大駕駛在時速 100 公里下使用特斯拉 FSD 時睡著,並透過佩戴墨鏡規避了駕駛監控系統。此事件凸顯了視覺監控系統在眼部被遮擋時的侷限性。

印度政府針對 Meta 旗下 Instagram 與 WhatsApp 出現兒童虐待相關廣告發出警告。當局要求在一週內採取處置措施,否則將面臨監管行動。

一名 Tesla 駕駛在德州發生致命車禍後被控過失殺人。美國國家公路交通安全管理局 (NHTSA) 目前正在調查此事件。

澳洲正帶頭推動國際努力,限制兒童使用社群媒體,引發全球對科技監管的辯論。此轉變暗示科技產業可能面臨類似「菸草業」的監管時刻,顯示平台設計與安全性將受到更嚴格的審查。

一輛小馬智行無人駕駛車在北京發生碰撞事故,該車在變道後突然煞車導致後車追尾,隨後未停車處理直接駛離現場。

由於俄羅斯 Zvezda 服務艙的空氣洩漏加劇,NASA 下令宇航員進入停靠的 SpaceX Crew Dragon 太空船避險。在俄方暫停維修作業後,該狀況已解除。

愛沙尼亞政府發布了一項新的基準測試,旨在評估各種 LLM 如何處理並抵禦俄羅斯的戰略敘事。這項研究為模型在應對地緣政治假訊息方面的安全性和對齊提供了關鍵見解。