
具記憶體安全性的代理工具
SkillEffect 是一個經過檢查的 lowering 執行環境,會在執行前將代理程式產生的工具程式轉換為經稽核且受記憶體限制的實作。其共用執行環境支援六類運算子,能在固定記憶體上限下提升完成率,並拒絕對抗性提案。
Tag: #agent-tools24 results

SkillEffect 是一個經過檢查的 lowering 執行環境,會在執行前將代理程式產生的工具程式轉換為經稽核且受記憶體限制的實作。其共用執行環境支援六類運算子,能在固定記憶體上限下提升完成率,並拒絕對抗性提案。

全新的 @agent-browser/eve 擴充功能,讓 eve agents 能使用瀏覽器自動化工具,包括瀏覽頁面、讀取內容、點擊、填寫表單、擷取螢幕截圖,以及檢查主控台與網路活動。Chromium 與 agent-browser 會在 eve sandbox 中執行,並提供網域限制與憑證保護控制。
OpenClaw 2026.4.7 推出首屈一指的 CLI 推斷中心,用於跨模型、媒體等的供應商支援推斷工作流程。主要新增包括媒體生成自動後備、恢復記憶維基堆疊、Webhook 外掛、插件式壓縮,以及對 Gemma 4、Arcee AI 和 Ollama 視覺的新支援。這些強化提升代理可靠性、供應商整合與工作階段管理。

研究人員透過無工具定義提示,反向工程 gpt-oss-20b 的內部分佈工具,確認高信心工具呼叫。他們在 GitHub 建置原生 harmony agent 框架,避開 Chat Completions API 的損失。這實現首個獨立重現 OpenAI 分數:SWE HIGH 60.4%、MEDIUM 53.3%、AIME25 91.7%。
DiffMem 團隊以單一唯讀 shell 命令工具取代複雜檢索管道,利用 LLM 訓練資料中內建的 Git 專業知識。代理使用 git log、grep 進行高效、精簡脈絡查詢,能發現關鍵字無法觸及的時間洞察。真實範例透過提交歷史將生日訊息連結至工作記憶。

Trace-Free+ 是一種課程學習框架,用於在無執行追蹤的情況下優化 LLM 代理的工具描述。它透過從追蹤豐富環境轉移監督至無追蹤部署,利用從多樣工具建構的大規模資料集。StableToolBench 和 RestBench 實驗顯示,對未見工具有顯著提升、跨領域泛化,並可擴展至超過 100 個候選工具。

文章報導,DeepSeek Harness 外掛在 GitHub 上迅速受到關注。社群打造的擴充功能據稱包括長期記憶、電子寵物,以及 4399 類型的瀏覽器小遊戲。
本文介紹 Skill Hub 如何透過一鍵操作調用技能,提升 AI Agent 的實作能力。內容強調以更實用的方式組織與使用 Agent 能力。
OpenClaw 的 Beta 版本新增 Telegram QA 自動化、Discord 即時語音診斷,以及 talk 會話的操作員指令。它更新了 OpenAI 6.37.0 和 Google GenAI 2.0.1 等 AI 依賴項,並修復代理掛起、cron 任務和 CLI 配置問題。增強重點在語音處理、技能安裝和壓縮上。
Qwen-Code v0.15.7 引入 FileReadCache 優化讀取、統一工具執行權限,以及背景代理恢復功能。CLI 改進包括模型切換、工作對話框和匯出導航,同時修復遙測並支援 DeepSeek 推理。多項錯誤修復提升核心、CLI 和提供者的穩定性。