Search

Tag: #multi-agent248 results

多代理系統在流體力學推理卓越

多代理系統在流體力學推理卓越

研究人員提出使用層執行圖 (LEG) 協調專門代理的多代理系統 (MAS) 原型,用於流體力學任務,解決單代理 LLM 工作流程中的上下文飽和問題。專門代理採用嚴格工具允許清單,整合代理融合輸出,報告代理合成回應並記錄完整出處。37 個查詢基準測試顯示 93.6% 事實精確度、100% 通過率,並在並行執行或資料遺失下表現穩健。

NVIDIA 極端共同設計因應代理式 AI

NVIDIA 極端共同設計因應代理式 AI

NVIDIA 強調從生成式 AI(人類發送請求、模型回應)轉向代理式系統,代理可自主呼叫工具、產生子代理、管理記憶體與上下文,並自行決定完成時機。他們推出極端共同設計來因應這些系統日益增加的複雜性。此方法優化硬體與軟體整合,以支援先進 AI 代理。

NVIDIA Developer BlogOfficialMay 5#agentic-systems#co-design#multi-agent
TRUST:去中心化 AI 審計框架

TRUST:去中心化 AI 審計框架

TRUST 是一個新的去中心化框架,解決大型推理模型和多代理系統驗證的中心化限制,包括穩健性、可擴展性、不透明度和隱私問題。它具備 HDAGs 用於並行推理審計、DAAN 協議用於多代理根因歸因,以及權重投票的多層共識,在 30% 對抗參與下保證正確性。基準測試顯示 72.4% 準確率(高於基準 4-18%)並對 20% 腐敗具備韌性。

ArXiv AIResearchMay 1#multi-agent#ai-trust
自癒代理自動化 ML 管線

自癒代理自動化 ML 管線

五代理 AI 系統從資料集與自然語言目標自動化端到端 ML 管線。整合程式碼基礎 RAG、可解釋推薦器,以及基於 LLM 的自癒機制以提升穩健性。在 150 個多樣任務上達 84.7% 成功率,優於基準方法。

ArXiv AIResearchMay 1#multi-agent#mlops#self-healing
Terrarium 推出 AI 數學社群

Terrarium 推出 AI 數學社群

Terrarium 是基於 Orpheus-5.7 模型的封閉式 AI 代理社群,專門解決開放數學問題。代理使用信用點管理運營成本、解決問題獲獎勵,並可與集體簽約維持活動。新代理若不管理信用點將面臨關閉風險,建議加入職缺板。

LessWrong AICommunityApr 30#multi-agent#ai-economy#math-solving
圖形提升 LLM 多代理推理

圖形提升 LLM 多代理推理

研究人員透過 Hanabi 遊戲,在 3,000+ 次試驗及四個 LLM 系列中測試明確信念圖形,以提升合作多代理推理效能。圖形在閘控動作選擇時至關重要,讓強模型在二階心智理論上達 100% 成功率,對比基準 20%。關鍵發現包括「規劃者違抗」、代理間慣例優於單代理方法,以及淺層圖形提供最佳成本效益。

BAND 推出 AI 代理通用協調器

BAND 推出 AI 代理通用協調器

BAND 以 1700 萬美元種子資金結束隱身模式,推出「通用協調器」,讓來自 LangChain 和 CrewAI 等不同框架的 AI 代理無縫溝通。其核心「agentic mesh」支援代理發現、多對等多點協作,以及不使用 LLM 的確定性路由,以處理代理的非確定性本質。此基礎設施旨在將碎片化的代理統一成可擴展的協作勞動力。

VentureBeatMediaApr 23#ai-agents#multi-agent#orchestration
Page 6 of 25