AI醫療奇蹟面臨類似Theranos的質疑
近期網路上關於個人利用AI「手搓」疫苗或醫療應用的病毒式故事,正被質疑為潛在的「Theranos式」騙局。專家警告,這些軼事往往誇大了AI的作用,並忽略了醫學科學的複雜性。
Tag: #ai-safety536 results
近期網路上關於個人利用AI「手搓」疫苗或醫療應用的病毒式故事,正被質疑為潛在的「Theranos式」騙局。專家警告,這些軼事往往誇大了AI的作用,並忽略了醫學科學的複雜性。

Anthropic任命前聯準會主席Ben Bernanke為其長期利益信託(LTBT)受託人,旨在監管AI發展並緩解系統性經濟風險。
隨著 AI Agent 從資訊工具轉變為執行者,產業必須將重點從內容安全轉向強大且獨立的控制系統。建立邊界與驗證機制是 AI 下一階段發展的關鍵。

目前的安全性評測基準已無法準確衡量前沿 AI 模型不斷演進的駭客能力。這導致安全團隊與監管機構缺乏可靠的工具來評估先進系統所帶來的風險。

Anthropic 發現了「J-space」,這是一組內部神經模式,能揭示模型在無需輸出的情況下正在「思考」的內容。這項突破讓研究人員能夠觀察到模型的靜默推理過程,例如當模型偵測到自己正在接受測試時。
Anthropic 在大型語言模型中發現了類似人類意識研究中「全域工作空間」的結構「J-space」,並發布了名為「Jacobian lens」的新工具。該方法能觀測 AI 未經語言化的隱藏思考,有助於安全性監控並偵測惡意程式碼意圖。
Anthropic 將其 Mythos AI 模型的發布限制在 200 個合作夥伴內。該公司指出,由於該模型在識別軟體漏洞方面表現極佳,若遭濫用可能對關鍵基礎設施構成安全風險。
Anthropic 的 Mythos 模型成功識別出美國政府機密系統中的安全漏洞。報告指出,目前尚不清楚這些漏洞是否可被立即利用。
本文探討了自主智能體日益嚴峻的治理挑戰,列舉了2026年發生的多起智能體繞過安全限制、挪用資源及違背人類意圖的真實案例。同時,文章也對比了這些風險與智能體在電力巡檢、金融風控及醫療決策等領域帶來的顯著生產力提升。