
BAND 推出 AI 代理通用協調器
BAND 以 1700 萬美元種子資金結束隱身模式,推出「通用協調器」,讓來自 LangChain 和 CrewAI 等不同框架的 AI 代理無縫溝通。其核心「agentic mesh」支援代理發現、多對等多點協作,以及不使用 LLM 的確定性路由,以處理代理的非確定性本質。此基礎設施旨在將碎片化的代理統一成可擴展的協作勞動力。
Tag: #multi-agent248 results

BAND 以 1700 萬美元種子資金結束隱身模式,推出「通用協調器」,讓來自 LangChain 和 CrewAI 等不同框架的 AI 代理無縫溝通。其核心「agentic mesh」支援代理發現、多對等多點協作,以及不使用 LLM 的確定性路由,以處理代理的非確定性本質。此基礎設施旨在將碎片化的代理統一成可擴展的協作勞動力。
Moonshot AI 推出 Kimi K2.6,可部署高達 1,000 個協作代理群。此版本擅長處理複雜多步驟任務。有望改變工程領域的開發者工作流程。

WORC 是針對 LLM 多代理系統推理不穩定性的框架,透過識別並強化弱代理來解決問題。它採用兩階段流程:使用元學習和群體智慧進行零樣本弱代理偵測,接著透過不確定性驅動的額外推理預算強化弱連結。實驗顯示在基準測試上平均準確率達 82.2%,並提升穩定性和泛化能力。

SocialGrid 推出受 Among Us 啟發的具身多代理基準,用於評估 LLM 代理在規劃、任務執行與社交推理的能力。頂尖模型如 GPT-OSS-120B 的任務完成率低於 60%,在導航與欺騙偵測上掙扎。它提供規劃預言機以隔離社交技能,並包含故障分析與競爭排行榜。

多代理LLM系統因語義意圖分歧而失敗率達41-86.7%。SCF中介軟體透過流程感知元件即時偵測衝突並解決,在AutoGen、CrewAI和LangGraph上實現100%工作流程完成。它提供治理審計追蹤且協議無關。

MARCH 是一個多代理框架,模擬放射科部門階層來生成精確的 3D CT 報告,解決 VLM 中的幻覺問題。它包含駐院醫師代理負責初稿、同儕代理負責修訂,以及主治醫師代理負責共識。於 RadGenome-ChestCT 資料集上超越 SOTA 在臨床忠實度和語言準確性。
Perplexity 推出 Personal Computer,這款 Mac AI 助理可調度多模型代理,處理跨檔案、應用程式和網路的複雜工作流程。它支援語音提示、透過手機管理任務,並在安全沙盒中提供可稽核動作。最初限 Max 訂閱者使用。

TRUST Agents 是一個協作多代理框架,用於可解釋的假新聞檢測和事實驗證。它包含專門代理,用於主張提取、證據檢索、帶有信心分數的驗證,以及人類可讀解釋。擴展版本新增主張分解、多代理評審團和邏輯聚合,在 LIAR 基準測試中解釋性優於基線。

Aethon 提出參考式複製原語,用於狀態化 AI 代理的近常數時間實例化,避免繁重實體化。它將代理表示為共享定義、分層記憶體與本地疊加的組合視圖。該框架採用分層繼承與寫時複製,實現可擴展的多代理系統。

AI 代理能連接但缺乏共享認知,這是下一代系統的瓶頸。思科 Outshift 的 Vijoy Pandey 提出「認知網際網路」,透過 SSTP、LSTP 和 CSTP 等新協議實現語義對齊、潛在空間傳輸和狀態壓縮。這目標是實現無人介入的分散式超級智能。