Google DeepMind 與 Isomorphic Labs 的生物韌性策略
Google DeepMind 與 Isomorphic Labs 正在合作,為先進 AI 時代的生物韌性制定框架。該計畫旨在確保 AI 模型在生物研究環境中能安全地開發與部署。
Tag: #ai-safety538 results
Google DeepMind 與 Isomorphic Labs 正在合作,為先進 AI 時代的生物韌性制定框架。該計畫旨在確保 AI 模型在生物研究環境中能安全地開發與部署。

聯邦法官裁定,不得僅因研究人員從事內容審核工作而將其驅逐出境。此舉保護了分析 AI 生成內容與網路假訊息的研究人員。

Anthropic 正積極招募執法分析師,以防止其 AI 模型協助製造危險武器。這些職位描述反映了該公司將 AI 安全視為關鍵威脅評估過程的轉變。

Anthropic 承諾投入 1000 萬加幣資助八個加拿大研究機構,旨在推動有益且負責任的 AI 發展。此資金將支持包括 Amii、Mila 和 Vector Institute 在內的頂尖區域 AI 中心。

研究人員評估了 Gemini 2.5 Pro 解讀親子互動的能力。雖然該模型在基礎觀察方面表現出色,但目前仍缺乏在兒童發展溝通領域進行專家級判斷所需的細微差別。

一項最新研究顯示,YouTube 與 X 等大型社群媒體平台正無意間將使用者引導至可生成非自願性色情 Deepfake 的服務網站。這些服務以低至 1 美元的價格提供影像處理,凸顯了平台流量審核中存在的關鍵安全漏洞。

Anthropic 正處於政治與資本壓力的複雜環境中,常被視為 AI 產業的異類。本文探討了其未來發展路徑的不確定性。

Google 的內部深偽檢測系統被用於識別並揭穿一張關於參議員 Mitch McConnell 的 AI 生成假照片。此事件凸顯了自動化檢測工具在驗證數位媒體真實性方面日益重要的角色。
本文指出 AI 的主要風險並非幻覺,而是在真實世界系統中缺乏「邊界感」。作者建議在 AI 與現實執行之間建立獨立的控制層,以防止 AI 越過安全與責任的紅線。

近期關於全自動 AI 勒索軟體攻擊的報導已被釐清,顯示人類操作員仍需負責目標選擇與憑證管理。這凸顯了當前網路犯罪中的 AI 代理人更像是「戰力倍增器」,而非完全獨立的執行者。