🐯最新收集於 36m

Codex 正縮小與 Claude Code 的差距

Codex 正縮小與 Claude Code 的差距
PostLinkedIn
🐯閱讀原文: 虎嗅
#coding-agents#developer-tools#enterprise-ai#user-growthopenai-codexopenaicodexclaude-codeanthropictickertrends

💡Codex 突破 2,000 萬使用者、Claude Code 增速放緩,為編程代理選型提供重要訊號。

⚡ 30-Second TL;DR

有什麼變化

據報 OpenAI Codex 的每週活躍使用者已超過 2,000 萬。

為什麼重要

AI 編程代理市場正從單一領先者競爭,轉向涵蓋開發者與知識工作者的更廣泛競爭。Codex 的分發能力與跨職能覆蓋,可能與純粹的程式碼品質同等重要;Claude Code 則需要突破早期開發者市場的優勢範圍。

下一步行動

在同一個程式碼庫上對 OpenAI Codex 與 Claude Code 進行兩週評測,比較任務完成率、審查工作量、延遲與每位開發者成本。

誰應關注:Developers & AI Engineers

關鍵要點

  • 據報 OpenAI Codex 的每週活躍使用者已超過 2,000 萬。
  • 截至 8 月 10 日,TickerTrends 估算 Codex 四週增長率為 20.8%,Claude Code 為 5.2%。
  • Codex 的使用者不只包括開發者,非開發者約占使用者的 20%。
  • Claude Code 仍擁有強勁的企業使用量,在多家受追蹤公司中仍是主導工具。
  • 據報 OpenAI 本季企業業務年化收入增長約 50%,高於公司整體 35% 的增幅。

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 9 個來源。

🔑 增強重點摘要

  • OpenAI Codex 目前運行於 GPT-5.6 Sol 模型,在 Terminal-Bench 2.1 測試中以 85.8% 的成功率領先 Claude Code 的 84.6%。
  • Claude Code 則在 SWE-bench Verified 排行榜上保持優勢,成功率達到 97.0%,顯示其在複雜架構推理上的領先地位。
  • Codex 引入了平行子代理架構,允許在隔離的雲端沙盒中同時執行最多 8 個子代理,顯著提升了處理日常 PR 與任務的吞吐量。
  • 在成本效益方面,Codex 解決 DeepSWE 任務的平均成本為 8.39 美元,低於 Claude Code (Opus 5) 的 11.84 美元。
  • OpenAI 於 2026 年 8 月 13 日與 IBM 達成戰略合作,將 Codex 整合至 IBM Consulting 平台,旨在加速企業級遺留系統的現代化轉型。
📊 競品分析▸ Show
特性OpenAI CodexAnthropic Claude Code
核心模型GPT-5.6 SolClaude Opus 5
擅長領域終端速度、平行任務執行複雜多檔案重構、代理團隊協作
SWE-bench 成功率略低於 Claude97.0% (領先)
成本 (DeepSWE)$8.39/任務$11.84/任務
關鍵架構平行子代理 (最多 8 個)共享任務列表的代理團隊

🛠️ 技術深入

  • Codex 採用平行子代理架構,支援在隔離沙盒中同時運行 8 個任務,優化了高併發處理能力。
  • 兩者皆已達到 100 萬 Token 的上下文視窗,支援對超大型程式碼庫的直接分析。
  • 兩者均整合了模型上下文協議 (MCP),以實現與即時系統及企業內部數據的互動。
  • Claude Code 透過 Agent Teams 機制,在多檔案重構過程中維持跨任務的上下文一致性。

🔮 前景展望AI analysis grounded in cited sources

AI 代理將從單純的程式碼生成轉向系統級工程決策。
隨著兩大平台對代理控制與 MCP 協議的重視,開發者將更多地扮演審核者而非編寫者。
企業級市場將出現針對特定垂直領域的代理整合服務。
IBM 與 OpenAI 的合作模式顯示,將模型嵌入諮詢平台將成為企業採用 AI 代理的主要路徑。

時間線

2026-08-13
OpenAI 與 IBM 達成戰略合作,將 Codex 整合至 IBM Consulting 平台。
2026-08-20
Claude Code 發布 v2.1.238 版本,Codex CLI 更新至 v0.149.0。
2026-08-21
最新基準測試顯示 Codex 在 Terminal-Bench 2.1 領先,Claude Code 在 SWE-bench 領先。

📎 來源 (9)

Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.

  1. youtube.com
  2. morphllm.com
  3. teamvoy.com
  4. medium.com
  5. youtube.com
  6. ibm.com
  7. ai-maniacs.com
  8. openai.com
  9. developersdigest.tech
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 虎嗅

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。