Search

Tag: #coding-agents68 results

Terminus-4B:小型模型挑戰前沿LLM代理任務

Terminus-4B:小型模型挑戰前沿LLM代理任務

Terminus-4B 是經 SFT 和 RL 微調的 Qwen3-4B 模型,專門用於代理終端執行任務。它在 SWE-Bench Pro 和 C# 基準上匹配或超越 Claude Sonnet/Opus 和 GPT-5.3-Codex 等前沿模型,無性能損失下減少主代理 30% token 使用量。這實現編碼代理中高效的子代理隔離處理冗長任務。

ArXiv AIResearchMay 7#agentic-execution#coding-agents
GPT-5.5 在 Vercel AI Gateway 上線

GPT-5.5 在 Vercel AI Gateway 上線

Vercel AI Gateway 現提供 GPT-5.5 和 GPT-5.5 Pro,專為程式設計、電腦使用、知識工作及研究等長時間代理任務優化。這些模型比前一代更具 token 效率,並擅長在大規模程式碼庫中維持上下文。GPT-5.5 Pro 適用於商業及技術領域的嚴苛多步驟工作流程。

Page 4 of 7