
多代理系統自主重現同調概念
新型多代理系統透過產生猜想、嘗試證明,並利用演化資料分佈的回饋來發現數學概念。它在從多面體資料及線性代數知識中成功重現同調概念的基準測試中表現出色。消融實驗統計驗證了其動態局部過程的重要性。
Tag: #multi-agent248 results

新型多代理系統透過產生猜想、嘗試證明,並利用演化資料分佈的回饋來發現數學概念。它在從多面體資料及線性代數知識中成功重現同調概念的基準測試中表現出色。消融實驗統計驗證了其動態局部過程的重要性。

這篇 arXiv 論文提出評估與優化多代理對話式購物助理的藍圖,聚焦雜貨購物的挑戰如請求不完整。介紹多面向評估量規與對齊人類註解的 LLM-as-judge 管道。提出 Sub-agent GEPA 與新型 MAMuT GEPA 進行提示優化,並釋出實務模板。

這篇arXiv論文探討使用上位詞-下位詞等語義關係,從網路威脅情報(CTI)報告中提取資訊。多代理神經符號系統自動生成CLIPS程式碼,用於專家系統自動化防火牆規則以阻擋惡意流量。實驗顯示優於各基準表現。

EMPA 是一個針對 LLM 對話代理的人格對齊同理心評估的過程導向框架,解決使用者狀態潛在、回饋稀疏等挑戰。它將真實互動提煉成可控情境,並使用多代理沙盒測試策略適應。軌跡依心理空間的方向對齊、累積影響與穩定性評分。

WKGFC 以開放知識圖譜作為事實查核的核心證據,使用 LLM 代理透過 MDP 框架擷取相關子圖。透過網路內容補充知識圖譜證據,以處理多跳躍關係。此方法解決相似度基礎 RAG 的限制,提升泛化能力。

ProductResearch 提出多代理框架,合成高保真軌跡來訓練電子商務購物代理。它使用使用者代理、監督代理和研究代理,從細微意圖生成全面產品報告。經微調的緊湊 MoE 模型在深度和實用性上媲美專有系統。

解釋AI原生應用為機率性核心邏輯,而非AI增強附加,使用旅行規劃「靈感旅行家」為例。產品經理轉向意圖池、多模態輸入、Agent編排及動態交付。提供三個避免陷阱建議以實現真正AI整合。
Qwen3.5-35B 是首個可靠完成多代理工作流程的亞100B模型,能總結10個轉錄本,而 qwen3-coder-next 和 glm-4.7-flash 等模型因工具錯誤或無限迴圈失敗。超過100B的大型模型一致成功,gpt-oss-20b 在高推理努力下也能完成。測試儲存庫可輕鬆在本機複製。

Tec-Do Holdings 於2026年2月27日申請香港主板上市。該公司目標成為首家專注多代理AI行銷技術的上市公司。2025年已服務超過10萬廣告主。

美國 Amazon Web Services 發布其 AI 程式碼編輯器最新版本 Kiro 0.9。此更新允許為個別子代理分配前端或後端職責。它提升了多代理協作處理專門程式碼任務的能力。