
Discord AI 審核錯誤導致超過 8,000 名用戶被封禁
Discord 承認其 AI 審核系統出現錯誤,自 5 月以來將試算表、棋盤等無害圖像誤判為違規內容,導致超過 8,000 個帳號被錯誤封禁。
Tag: #content-moderation244 results

Discord 承認其 AI 審核系統出現錯誤,自 5 月以來將試算表、棋盤等無害圖像誤判為違規內容,導致超過 8,000 個帳號被錯誤封禁。

Discord 的自動化安全系統錯誤地封禁了超過 8,000 個帳號,原因僅是這些用戶上傳了包含網格的圖片(如棋盤或遊戲紋理)。Discord 已解封所有受影響用戶,並承認其內容審核流程存在技術故障。
Reddit 正在實施內部 AI 工具,以檢測並封鎖隱蔽的行銷內容。這些活動旨在透過人為增加品牌提及次數,來操縱 ChatGPT 和 Gemini 等 AI 聊天機器人。

一項最新研究顯示,AI 寫作工具即使在被要求保持原意的情況下,仍會持續將社群媒體貼文引導至特定立場。這凸顯了 AI 對齊的重大挑戰,以及自動化內容生成中潛在的非預期偏見問題。

印度政府針對 Meta 旗下 Instagram 與 WhatsApp 出現兒童虐待相關廣告發出警告。當局要求在一週內採取處置措施,否則將面臨監管行動。
印度政府已正式通知 Meta Platforms Inc.,要求其立即從包括 Instagram 在內的平台中移除涉及兒童的性內容。此舉凸顯了大型科技公司在內容審核與兒童安全方面正面臨日益嚴峻的監管壓力。

在 BBC 調查揭露 Instagram 投放推廣兒童性虐待內容的付費廣告後,印度政府正傳喚 Meta 高層。電子與資訊技術部要求該公司提供正式說明。
印度科技部長已下令官員傳喚 Meta Platforms Inc.,針對 Instagram 上出現兒童性虐待內容的問題進行說明。此舉凸顯了政府對平台安全與內容審核機制的監管力道正日益加強。
一份最新報告指出,熱門社交媒體應用程式的安全功能往往成效不彰。青少年仍能輕易接觸有害內容、與陌生人互動,並繞過家長設定的使用時間限制。

Yahoo Japan 推出了一項新功能,利用 OpenAI 的 API 來分析並分類用戶留言。該系統透過 AI 生成的圖表,將 Yahoo 留言區的主要討論焦點進行視覺化呈現。