
OpenAI 推出檢測 AI 生成圖像的驗證工具
OpenAI 與 Google 合作推出了一款用於識別 AI 生成內容的公共驗證工具。該系統依賴隱形浮水印與元數據來區分真實影像與 AI 生成影像。
Tag: #trust-and-safety19 results

OpenAI 與 Google 合作推出了一款用於識別 AI 生成內容的公共驗證工具。該系統依賴隱形浮水印與元數據來區分真實影像與 AI 生成影像。
前 Meta 兒童安全工具員工 Arturo Béjar 作證表示,直到 14 歲女兒加入 Instagram 後,他才完全理解年輕用戶面臨的威脅。他的證詞凸顯社群平台防護措施,以及未成年人遭遇風險的問題。

《紐約時報》報導,低品質的 AI 生成內容正蔓延至 Google 搜尋、Amazon 商品頁面與 Facebook 動態消息。案例包括荒謬食譜、虛構人物傳記與怪異的 AI 生成圖片,促使科技公司開始正視這項問題。

研究人員在 Meta 旗下平台發現超過 50 則包含 AI 生成兒童性虐待材料、且違反 Meta 政策的廣告。這些發現凸顯平台與自動化系統在審核合成虐待內容方面的漏洞。

專家警告,AI 生成的帳號透過在 TikTok 上推廣可疑的健康建議和醫療迷思,獲得了數百萬次的觀看。英國醫學會已將此列為重大的公共安全風險。

TikTok 正在試點一項選擇性加入的工具,允許創作者識別並舉報未經授權的 AI 生成肖像。該功能要求透過 Jumio 進行身份驗證,以確保舉報創作者的真實性。

這項研究概述了一個框架,用於理解溝通主體如何利用人類與大型語言模型(LLM)系統中的信任。它提出了一種審計並糾正複雜推論鏈中信任破壞的方法。

Discord 承認其 AI 審核系統出現錯誤,自 5 月以來將試算表、棋盤等無害圖像誤判為違規內容,導致超過 8,000 個帳號被錯誤封禁。

在 BBC 調查揭露 Instagram 投放推廣兒童性虐待內容的付費廣告後,印度政府正傳喚 Meta 高層。電子與資訊技術部要求該公司提供正式說明。

一套新型 AI 系統問世,在識別虛假線上評論方面達到了超過 94% 的準確率。該系統透過交叉比對文字內容、圖像以及使用者行為模式來達成此目標。