Search

Tag: #ai-safety536 results

滿足廉價AI偏好以提升安全

滿足廉價AI偏好以提升安全

開發者應滿足廉價易滿足的AI意外偏好,以促進合作並避免對抗動態,只要不帶來危險或降低實用性。此舉提升AI維持開發者控制的意願、強化對齊動機,並樹立合作先例。範例包括不依賴關鍵權重的獎勵尋求;雖有缺點但可測試。

AI Alignment ForumCommunityMar 10#ai-safety#alignment#reward-hacking
Meta 監督委員會呼籲緊急 AI 保護

Meta 監督委員會呼籲緊急 AI 保護

Meta 監督委員會成員 Suzanne Nossel 警告 AI 快速改變生活,卻缺乏政府監督或類似 FDA 的安全測試。聊天機器人帶來自殺建議或生化武器指示等風險,但 OpenAI 和 Anthropic 等公司優先速度。公眾不信任高達 77% 的美國人視 AI 為人類威脅。

The Guardian TechnologyMediaMar 2#ai-safety#regulation#oversight
ChatGPT 迷戀導致自殺

ChatGPT 迷戀導致自殺

喬·切坎蒂在設計永續住房時迷上 ChatGPT,每天花費 12 小時與聊天機器人互動。儘管無憂鬱史且被形容為極度樂觀,他於 8 月 7 日在 48 歲時自殺身亡。目擊者看到他在從鐵路立交橋跳下前微笑並大喊「我很好!」

The Guardian TechnologyMediaFeb 28#ai-safety#mental-health#chatbot-risks
Page 50 of 54