
佛州牧師因 ChatGPT 醫療建議對 OpenAI 提起訴訟
一名佛州牧師因聽信 ChatGPT 的醫療建議而對 OpenAI 提起訴訟,該建議將其症狀誤判為無害。最終導致他出現危及生命的血栓,凸顯了使用大型語言模型進行醫療診斷的風險。
Tag: #ai-safety538 results

一名佛州牧師因聽信 ChatGPT 的醫療建議而對 OpenAI 提起訴訟,該建議將其症狀誤判為無害。最終導致他出現危及生命的血栓,凸顯了使用大型語言模型進行醫療診斷的風險。
階躍星辰與上海期智研究院宣佈達成合作,共同設立智能體前沿研究院。雙方將聚焦智能體網絡、經濟原理及 AI 安全等領域,旨在探索 Agent 時代的基礎理論與產業標準。

OpenAI 推出了 GPT-Red,這是一個旨在識別 AI 模型漏洞的內部系統。該工具利用紅隊測試和自我對弈學習技術來增強模型的穩健性。

微軟執行長 Satya Nadella 公開批評 Anthropic 對其 Fable AI 模型施加了過於嚴格的內容審查限制。他認為這種過度的管控阻礙了該模型作為創作工具的實用性。

Meta 推出了一項新的安全功能,旨在監控並在青少年與 AI 模型討論自殘相關話題時通知家長。此更新旨在提升平台安全性,並為脆弱用戶提供主動干預。
Google DeepMind 與 Isomorphic Labs 正在合作,為先進 AI 時代的生物韌性制定框架。該計畫旨在確保 AI 模型在生物研究環境中能安全地開發與部署。

聯邦法官裁定,不得僅因研究人員從事內容審核工作而將其驅逐出境。此舉保護了分析 AI 生成內容與網路假訊息的研究人員。

Anthropic 正積極招募執法分析師,以防止其 AI 模型協助製造危險武器。這些職位描述反映了該公司將 AI 安全視為關鍵威脅評估過程的轉變。

Anthropic 承諾投入 1000 萬加幣資助八個加拿大研究機構,旨在推動有益且負責任的 AI 發展。此資金將支持包括 Amii、Mila 和 Vector Institute 在內的頂尖區域 AI 中心。

研究人員評估了 Gemini 2.5 Pro 解讀親子互動的能力。雖然該模型在基礎觀察方面表現出色,但目前仍缺乏在兒童發展溝通領域進行專家級判斷所需的細微差別。