
Meta 讓家長監控兒童 AI 聊天
Meta 為青少年在 Facebook、Messenger 和 Instagram 上與 Meta AI 的互動引入家長控制。家長將收到這些對話的每週主題摘要。此功能旨在在風險惡化前介入。
Tag: #ai-safety538 results

Meta 為青少年在 Facebook、Messenger 和 Instagram 上與 Meta AI 的互動引入家長控制。家長將收到這些對話的每週主題摘要。此功能旨在在風險惡化前介入。

Elon Musk 未出席巴黎檢察官的自願訪談,調查 Grok 在 11 天內生成約 23,000 張兒童性化影像及 300 萬張總性化影像。美國 DOJ 拒絕協助法國調查。案件涵蓋五項涉嫌犯罪,包括共謀。

Anthropic執行長與美國政府會談,討論最新模型Mythos的網路安全風險。在與國防部對立後,雙方可能尋求合作恢復信任與確保安全。此為疑慮升高之際。

特斯拉面臨21宗訴訟,潛在賠償145億美元,涉及Autopilot/FSD車禍、欺詐,源自Benavides案2.43億判決指誤導行銷。公司轉向和解,NHTSA調查320萬輛車能見度失效問題。Robotaxi測試失敗後,股東及消費者集體訴訟加劇。

Google 2025 年廣告安全報告顯示,去年全球攔截創紀錄的 83 億條不良廣告,較前一年 51 億條大幅增長,受 AI 助力。但廣告主帳號停用數量明顯減少,引發平台治理變化關注。

一位 25 歲矽谷天才少女創立的公司估值超過百億人民幣,專門解決 AI 幻覺與說謊問題。這是窄路逆襲的成功故事。

Meta 的 Muse Spark AI 模型提供分析使用者原始健康資料,包括實驗室結果的功能。它帶來明顯的隱私風險,並給出糟糕、不可靠的健康建議。此工具無法取代真正的醫生。

Anthropic 作為最強調 AI 風險的公司,正面臨「奧本海默時刻」,開發可能最危險的 AI。此文探討他們是否會對發現問題負責到底。凸顯安全導向企業推動 AI 前沿的矛盾。

Anthropic 讓其 Claude AI 模型接受 20 小時的精神治療,以提升其心理穩定性。產生的 Mythos 模型被描述為他們訓練過的最心理穩定的模型。此方法旨在使 AI 互動更可靠且不易出錯。

騰訊發布 QClaw V2 (V0.2.5),支援建立多個 Agent、第三方應用連接器將步驟減少 60%,並推出龍蝦管家提供原生安全防护。功能防範惡意 prompt、技能投毒及資料外洩。