ABC:可靠AI代理的行為合約

💡新框架將代理漂移限 <0.27,基準達 88-100% 遵守率。(38字)
⚡ 30-Second TL;DR
有什麼變化
ABC 定義為 (P, I, G, R) 以強制代理行為
為什麼重要
透過行為形式化與漂移界限,使自主 AI 代理部署更可靠。基準測試顯示違規偵測與遵守率大幅改善,解決代理式 AI 關鍵失效模式。
下一步行動
在您的 AI 代理管線中實作 AgentAssert 以強制 ABC 合約。
關鍵要點
- •ABC 定義為 (P, I, G, R) 以強制代理行為
- •漂移界限定理:恢復率 γ > α 將漂移限於 α/γ
- •AgentAssert 每會話偵測 5.2-6.8 軟違規,對比基線
- •88-100% 硬約束遵守率,<10ms/動作額外負荷
- •在 AgentContract-Bench 上評估 1,980 會話跨 7 模型
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 9 個來源。
🔑 增強重點摘要
🛠️ 技術深入
• ABC合約結構C = (P, I, G, R):前提條件(Preconditions)、不變式(Invariants)、治理政策(Governance policies)、恢復機制(Recovery mechanisms)作為一級可執行元件[1] • (p, delta, k)-滿足性:機率化合約遵守概念,考量LLM非決定性與恢復機制[3] • 漂移界限定理:恢復率γ > α(自然漂移率)時,行為漂移界限為D* = α/γ(期望值),隨機設定中具高斯集中性[3] • ContractSpec支援硬/軟約束分離、表達式謂詞、檔案參考組合用於多代理管道[1] • 狀態空間S包含代理內部上下文(對話歷史、累積工具輸出、工作記憶)與可觀測環境;動作空間A包含所有可能輸出(文本回應、工具呼叫、API調用)[1] • 多代理鏈中安全合約組合的充分條件與機率降級界限已推導[3] • 運行時執行開銷<10ms/動作[1]
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
📎 來源 (9)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ArXiv AI ↗
每週 AI 簡報
每週一封,可隨時退訂。


