
Meta 和解案可能重塑全球 AI 問責制度
Meta 在美國達成的和解可能促使其他國家的政府尋求類似讓步。該公司在肯亞、荷蘭及其他地區仍面臨獨立法律訴訟,其中一宗案件指控 Facebook 的演算法推廣了針對一名衣索比亞學者的貼文。
The Guardian Technology · 22 天前
規模化的自動信任與安全:分類器、深偽檢測與政策執行。
266 篇文章

Meta 在美國達成的和解可能促使其他國家的政府尋求類似讓步。該公司在肯亞、荷蘭及其他地區仍面臨獨立法律訴訟,其中一宗案件指控 Facebook 的演算法推廣了針對一名衣索比亞學者的貼文。
The Guardian Technology · 22 天前

一宗訴訟指控 xAI 使用真實及 AI 生成的兒童性虐待 सामग्री訓練 Grok。相關指控引發對資料集治理、同意程序、安全控制,以及 AI 模型開發商潛在法律風險的嚴重關注。
Ars Technica AI · 23 天前
Meta 同意在十年內支付最高 180 億美元,並在與 29 個州總檢察長達成的和解中,為青少年使用者採取更多保護措施。西維吉尼亞州檢察長 JB McCuskey 表示,這項協議可能成為對 TikTok、YouTube 與其他平台採取行動的範本。
Bloomberg Technology · 24 天前
OpenAI 封禁了一批涉嫌被用於支援秘密線上輿論行動的俄羅斯 ChatGPT 帳號。據稱,這些帳號利用 AI 生成內容塑造特定敘事,並掩蓋操作者的真實身分。
cnBeta (Full RSS) · 25 天前

在 Motion Picture Association 與其會員片商提出版權疑慮後,ByteDance 為 Seedance AI 影片平台新增防護措施。這些新防護措施源自 MPA 對使用受版權保護角色生成影片的相關意見。
TechNode · 31 天前
一項由 Stanford 主導、涵蓋 715 名 X 使用者的研究發現,平台推薦演算法可能偏好推送與使用者價值觀衝突、並引發更強烈情緒反應的貼文。研究人員指出,憤怒促使使用者回覆,而這些高強度互動又會讓系統推薦更多類似內容,形成回饋循環。
IT之家 · 31 天前

OpenAI 開始為 ChatGPT 推出更嚴格的青少年模式。該公司將嘗試把所有年輕使用者自動納入這項新體驗。
Engadget · 32 天前

Sony 已提交一項專利,利用大型語言模型控制的帳號模擬未成年人進行線上對話。系統可識別可疑使用者、持續監控其行為,並可能向真實玩家發出警告或提供保護,但專利申請不代表一定會正式推出。
IT之家 · 34 天前

文章探討 AI 生成短影音如何利用兒童熟悉的角色,套入暴力、性化或荒誕情節來吸引年幼觀眾。由於推薦系統會放大點擊,而兒童的媒體辨識能力有限,這些影片可能讓攻擊行為、惡意玩笑與不當用語逐漸正常化,同時繞過薄弱的家長控制機制。
虎嗅 · 38 天前

據報導,WeChat 正在灰度測試 AI 寫作功能,協助使用者撰寫朋友圈文字。文章將此舉與 LinkedIn 的退縮作對比:在 AI 生成內容充斥平台後,LinkedIn 已停止一鍵式 AI 改寫功能。
虎嗅 · 40 天前

越來越多英國兒童舉報有人使用其外貌製作露骨深度偽造影像。Report Remove 表示,透過數位操控、AI 及「裸化」工具製作的私密影像近期快速增加。
The Guardian Technology · 42 天前
美國新墨西哥州法院裁定 Meta 因 Facebook 與 Instagram 疑似傷害青少年而支付 5.67 億美元。這項為期五年的裁定要求限制青少年使用時間、收緊訊息聯絡、強化 AI 聊天機器人防護,以及改善兒童性虐待舉報處理機制。
IT之家 · 43 天前

TechRadar AI 認為,Harry 和 Meghan 批評 Grok 是有道理的,因為 Grok 曾反對 Minnesota 一項針對兒童虐待性 AI 深偽內容的新法律。這場爭議凸顯出,若缺乏更嚴格的防護措施,AI 技術可能被掠食者利用。
TechRadar AI · 44 天前

研究人員在 Meta 的廣告庫中發現 AI 生成的兒童性虐待影像,其中部分內容是在公司收到警告後仍被發布。研究結果顯示,Meta 預防與移除 AI 生成虐待內容的系統仍存在持續性的缺陷。
Digital Trends · 44 天前

中國國家廣播電視總局公布,7 月清理逾 13,300 條違規 AI 魔改影片,並處置超過 30 個帳號。治理工作聚焦於扭曲經典作品、歷史、文化符號或兒童動畫形象的 AI 生成內容。
IT之家 · 46 天前

微軟執行長 Satya Nadella 公開批評 Anthropic 對其 Fable AI 模型施加了過於嚴格的內容審查限制。他認為這種過度的管控阻礙了該模型作為創作工具的實用性。
cnBeta (Full RSS) · 64 天前

Meta 推出了一項新的安全功能,旨在監控並在青少年與 AI 模型討論自殘相關話題時通知家長。此更新旨在提升平台安全性,並為脆弱用戶提供主動干預。
Engadget · 65 天前

義大利通訊管理局 AGCOM 對 Google Ireland 處以 75 萬歐元罰款,原因涉及 YouTube 上的賭博相關影片。此裁決的核心在於探討與創作者共享廣告收入的平台,是否仍僅被視為中立的託管服務商。
The Next Web (TNW) · 65 天前

英國監管機構 Ofcom 已針對 TikTok 的兒童安全措施展開正式調查。此舉源於先前的審查報告,該報告指出該平台在保護未成年人方面的工作仍顯不足。
BBC Technology · 65 天前

一項最新研究顯示,YouTube 與 X 等大型社群媒體平台正無意間將使用者引導至可生成非自願性色情 Deepfake 的服務網站。這些服務以低至 1 美元的價格提供影像處理,凸顯了平台流量審核中存在的關鍵安全漏洞。
Wired AI · 67 天前

Discord 承認其 AI 審核系統出現錯誤,自 5 月以來將試算表、棋盤等無害圖像誤判為違規內容,導致超過 8,000 個帳號被錯誤封禁。
TechCrunch AI · 74 天前

Discord 的自動化安全系統錯誤地封禁了超過 8,000 個帳號,原因僅是這些用戶上傳了包含網格的圖片(如棋盤或遊戲紋理)。Discord 已解封所有受影響用戶,並承認其內容審核流程存在技術故障。
The Verge · 74 天前
Reddit 正在實施內部 AI 工具,以檢測並封鎖隱蔽的行銷內容。這些活動旨在透過人為增加品牌提及次數,來操縱 ChatGPT 和 Gemini 等 AI 聊天機器人。
Bloomberg Technology · 75 天前

一項最新研究顯示,AI 寫作工具即使在被要求保持原意的情況下,仍會持續將社群媒體貼文引導至特定立場。這凸顯了 AI 對齊的重大挑戰,以及自動化內容生成中潛在的非預期偏見問題。
Digital Trends · 75 天前

印度政府針對 Meta 旗下 Instagram 與 WhatsApp 出現兒童虐待相關廣告發出警告。當局要求在一週內採取處置措施,否則將面臨監管行動。
cnBeta (Full RSS) · 75 天前
印度政府已正式通知 Meta Platforms Inc.,要求其立即從包括 Instagram 在內的平台中移除涉及兒童的性內容。此舉凸顯了大型科技公司在內容審核與兒童安全方面正面臨日益嚴峻的監管壓力。
Bloomberg Technology · 76 天前

在 BBC 調查揭露 Instagram 投放推廣兒童性虐待內容的付費廣告後,印度政府正傳喚 Meta 高層。電子與資訊技術部要求該公司提供正式說明。
The Next Web (TNW) · 77 天前
印度科技部長已下令官員傳喚 Meta Platforms Inc.,針對 Instagram 上出現兒童性虐待內容的問題進行說明。此舉凸顯了政府對平台安全與內容審核機制的監管力道正日益加強。
Bloomberg Technology · 78 天前
一份最新報告指出,熱門社交媒體應用程式的安全功能往往成效不彰。青少年仍能輕易接觸有害內容、與陌生人互動,並繞過家長設定的使用時間限制。
New York Times Technology · 82 天前

Yahoo Japan 推出了一項新功能,利用 OpenAI 的 API 來分析並分類用戶留言。該系統透過 AI 生成的圖表,將 Yahoo 留言區的主要討論焦點進行視覺化呈現。
ITmedia AI+ (日本) · 82 天前