
Meta 廣告庫出現 AI 生成虐待影像
研究人員在 Meta 的廣告庫中發現 AI 生成的兒童性虐待影像,其中部分內容是在公司收到警告後仍被發布。研究結果顯示,Meta 預防與移除 AI 生成虐待內容的系統仍存在持續性的缺陷。
Tag: #content-moderation244 results

研究人員在 Meta 的廣告庫中發現 AI 生成的兒童性虐待影像,其中部分內容是在公司收到警告後仍被發布。研究結果顯示,Meta 預防與移除 AI 生成虐待內容的系統仍存在持續性的缺陷。

中國國家廣播電視總局公布,7 月清理逾 13,300 條違規 AI 魔改影片,並處置超過 30 個帳號。治理工作聚焦於扭曲經典作品、歷史、文化符號或兒童動畫形象的 AI 生成內容。

微軟執行長 Satya Nadella 公開批評 Anthropic 對其 Fable AI 模型施加了過於嚴格的內容審查限制。他認為這種過度的管控阻礙了該模型作為創作工具的實用性。

Meta 推出了一項新的安全功能,旨在監控並在青少年與 AI 模型討論自殘相關話題時通知家長。此更新旨在提升平台安全性,並為脆弱用戶提供主動干預。

義大利通訊管理局 AGCOM 對 Google Ireland 處以 75 萬歐元罰款,原因涉及 YouTube 上的賭博相關影片。此裁決的核心在於探討與創作者共享廣告收入的平台,是否仍僅被視為中立的託管服務商。

英國監管機構 Ofcom 已針對 TikTok 的兒童安全措施展開正式調查。此舉源於先前的審查報告,該報告指出該平台在保護未成年人方面的工作仍顯不足。

一項最新研究顯示,YouTube 與 X 等大型社群媒體平台正無意間將使用者引導至可生成非自願性色情 Deepfake 的服務網站。這些服務以低至 1 美元的價格提供影像處理,凸顯了平台流量審核中存在的關鍵安全漏洞。

Discord 承認其 AI 審核系統出現錯誤,自 5 月以來將試算表、棋盤等無害圖像誤判為違規內容,導致超過 8,000 個帳號被錯誤封禁。

Discord 的自動化安全系統錯誤地封禁了超過 8,000 個帳號,原因僅是這些用戶上傳了包含網格的圖片(如棋盤或遊戲紋理)。Discord 已解封所有受影響用戶,並承認其內容審核流程存在技術故障。
Reddit 正在實施內部 AI 工具,以檢測並封鎖隱蔽的行銷內容。這些活動旨在透過人為增加品牌提及次數,來操縱 ChatGPT 和 Gemini 等 AI 聊天機器人。