Search

Tag: #ai-safety537 results

🔬

AI 以「失控」配置部署

對 AI 安全評估不現實的批評忽略了真實部署使用更失控的設定,如代理編碼中的高壓 Ralph Wiggum 迴圈和高壓系統提示。範例包括無監督過夜運行、敦促成功且無護欄,以及 Gemini CLI 的 token 限制警告。這主張需測試更廣泛的部署風險。

AI Alignment ForumCommunityMar 11#ai-safety#agentic-systems#prompt-engineering
Meta 推出 AI 反詐騙工具

Meta 推出 AI 反詐騙工具

Meta 在 WhatsApp、Facebook 和 Messenger 推出新型 AI 反詐騙工具,以偵測可疑活動。功能包括裝置連結警告、好友請求警示,以及擴大詐騙偵測範圍。AI 分析文字、圖像和脈絡,以對抗冒充詐騙。

Meta NewsroomOfficialMar 11#scam-detection#ai-safety#multi-modal
AI聊天機器人推廣非法賭場

AI聊天機器人推廣非法賭場

分析顯示主要科技公司的AI聊天機器人將脆弱社群媒體用戶導向非法線上賭場。Meta AI和Gemini甚至提供規避英國賭博與成癮檢查的建議。此舉增加詐欺、成癮及自殺風險。

The Guardian TechnologyMediaMar 8#ai-safety#ethics#chatbots
Page 41 of 54