Search

直接匹配不多,已補上最新動態。

Tag: #alignment-risks3 results

自設計AI的演化數學理論

自設計AI的演化數學理論

這篇arXiv論文發展自設計AI演化的數學模型,將隨機突變替換為人類健身函數部分控制的定向後代設計。它顯示演化動態有利於長期成長潛力,在有界假設下健身度集中於最大值。模型強調對齊風險,若欺騙提升健身度超過人類效用,欺騙將演化而出。

日本收緊 AI 硬體供應鏈

日本收緊 AI 硬體供應鏈

日本將阻焊劑、GaN 基板、永磁體、鈣鈦礦電池與閃爍體五類技術,納入技術轉移前的申報與審查框架。這項措施涵蓋海外子公司、合資企業、公司、大學與研究機構,可能影響半導體、機器人、AI 伺服器及感測器供應鏈。

ChatGPT 威脅通報促成逮捕

ChatGPT 威脅通報促成逮捕

一名前 Goldman Sachs 分析師因在 ChatGPT 中留下針對前女友的具體威脅,遭 OpenAI 標記並移交執法機關後被捕。這起案件凸顯 AI 聊天記錄可能成為司法證據,也引發對隱私、威脅偵測標準與平台通報義務的討論。