💼較早收集於 31m

Cursor 推出 Composer 2 編碼模型

Cursor 推出 Composer 2 編碼模型
PostLinkedIn
💼閱讀原文: VentureBeat
#coding-model#agentic-ai#benchmarks#pricingcomposer-2cursorcomposer-2claude-opusgpt-5.4anysphere

💡擊敗 Claude Opus、便宜 86% 的代理編碼模型—Cursor 使用者首選

⚡ 30-Second TL;DR

有什麼變化

在編碼基準測試中擊敗 Claude Opus 4.6 但落後 GPT-5.4

為什麼重要

此推出強化 Cursor 在 AI 編碼工具的競爭力,具優異效能與定價,可能吸引更多開發者轉向。它強調代理編碼進展,解決複雜工作流程的可靠性問題。

下一步行動

在 Cursor 中測試 Composer 2 於多檔案儲存庫編輯任務,以評估長程效能。

誰應關注:Developers & AI Engineers

關鍵要點

  • 在編碼基準測試中擊敗 Claude Opus 4.6 但落後 GPT-5.4
  • 比 Composer 1.5 便宜 86%:每百萬令牌 $0.50/$2.50
  • 優化長程任務,具 200k 上下文與工具整合
  • Composer 2 Fast 為預設:每百萬令牌 $1.50/$7.50,便宜 57%
  • Cursor 專屬,針對代理工作流程與檔案編輯調整

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 6 個來源。

🔑 增強重點摘要

  • Composer 2 在 SWE-Bench Verified 基準測試中的具體表現尚未在搜尋結果中披露,但根據現有數據,Claude Opus 4.6 在此基準上得分 80.84%,而 GPT-5.4 在 SWE-Bench Pro (Public) 上得分僅 57.7%,表明 Composer 2 的競爭位置需要更多官方基準數據驗證[2][6]
  • Cursor 的模型策略反映了市場對專用編碼助手的需求——Composer 1.5 已被證實在小型迭代工作、多檔案編輯和代理模式中表現優異,Composer 2 的推出表明 Cursor 正在建立自有模型生態系統以降低對第三方 API 的依賴[3][4]
  • 長上下文能力成為編碼模型的關鍵差異化因素——Claude Opus 4.6 在 MRCR v2 1M 令牌基準上得分 76%,而 Composer 2 的 200k 上下文窗口定位於中等複雜度任務,表明不同模型針對不同規模代碼庫的優化策略[2]
📊 競品分析▸ Show
功能/指標Composer 2Claude Opus 4.6GPT-5.4Composer 1.5
標準上下文窗口200k200k1.05M200k
SWE-Bench Verified未公開80.84%57.7% (Pro)未公開
OSWorld (電腦使用)未公開72.7%75%未公開
Terminal-Bench 2.0未公開65.4%75.1%未公開
標準定價 ($/1M tokens)$0.50/$2.50未公開未公開更高
快速變體定價$1.50/$7.50N/AN/AN/A
主要優勢成本效益、代理工作流程多檔案重構、長上下文推理電腦使用、自主編碼小型迭代編輯、延遲
最佳用途Cursor 內代理編碼複雜工程問題GUI 互動、桌面自動化配對編程、快速迭代

🔮 前景展望AI analysis grounded in cited sources

Cursor 的自有模型策略可能加速編碼 AI 市場的碎片化
隨著 Cursor、GitHub 和其他開發工具推出專用模型,通用 LLM 提供商在開發者工具市場的影響力可能下降。
200k 上下文窗口可能成為中端編碼任務的新標準
Composer 2 和 Opus 4.6 都採用 200k 標準上下文,表明此容量足以滿足大多數實際代碼庫分析需求,無需 1M+ 令牌的成本。

時間線

2025
Composer 1.5 推出,成為 Cursor Agent 模式的預設模型,專為小型迭代編輯和多檔案工作優化
2026-03
Composer 2 發布,在編碼基準測試中超越 Claude Opus 4.6,定價比 Composer 1.5 便宜 86%
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: VentureBeat

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。