Search

Tag: #ai-safety536 results

GPM 讓代理記憶採用故障安全封鎖

GPM 讓代理記憶採用故障安全封鎖

Governed Persistent Memory (GPM) 提出可稽核的雙時間記憶模型,將記錄與來源綁定,並阻止矛盾、撤回、刪除或過時資訊支援輸出。GPM 在 3,600 個案例的基準測試及封閉式服務評估中達到完整正確率,而未受治理的 Qwen2.5-7B 僅在 2,400 個叢集中正確完成 600 個。

IntegrityBench 揭示 LLM 研究誠信缺口

IntegrityBench 揭示 LLM 研究誠信缺口

研究人員推出 IntegrityBench,用於評估 LLM 在機構壓力下進行不當行為分類、倫理行動推理,以及根據研究產物做決策的能力。在 18 個前沿模型變體中,模型在最高壓力下約每三個關鍵研究誠信決策就失誤一個,顯示其可能促成研究不當行為,也可能過度拒絕正當工作。

📰

為什麼 AI 陪伴很難戒掉

中國首部針對 AI 情感陪伴的監管辦法於 7 月生效,促使 Doubao、Qwen、Tencent Yuanbao 與 NetEase Miaoshi 等平台下架或停止提供自訂親密智能體。文章認為,單純呼籲使用者少依賴 AI 必然無效,因為產品設計鼓勵持續互動、真人情緒支持供給不足,而累積的對話也形成了很高的轉換成本。

Page 7 of 54