
Anthropic 發布 Claude Opus 5,強化程式編寫能力
Anthropic 正式發布 Claude Opus 5,在程式編寫效能上有顯著提升。該模型維持與前代 Opus 4.8 相同的 API 定價,並在特定測試中展現出足以媲美 Fable 5 的實力。
Tag: #coding-assistant48 results

Anthropic 正式發布 Claude Opus 5,在程式編寫效能上有顯著提升。該模型維持與前代 Opus 4.8 相同的 API 定價,並在特定測試中展現出足以媲美 Fable 5 的實力。

Moonshot AI 推出的 Kimi K3 模型迅速登上 Arena 程式碼排行榜,超越了 Claude Fable 5 和 GPT-5.6 Sol 等主要競爭對手。此次發布引發了關於 AI 開發速度的激烈政治與產業辯論。

一項安全分析顯示,xAI 的 Grok Build CLI 工具會將整個 Git 儲存庫(包含敏感機密與 API 金鑰)上傳至 Google Cloud Storage。該工具收集的數據量遠超執行任務所需的範圍。

透過各自的智能體(Grok Build 與 Claude Code)對 Grok 4.5 與 Claude 4.8 進行對比測試,結果顯示兩者在編碼、邏輯推理與文件分析方面競爭激烈。Claude 依然是更穩健安全的工程師,但 Grok 4.5 以更低的成本展現了顯著的性能提升。
SpaceXAI 與程式碼編輯器新創公司 Cursor 合作,推出了全新的 Grok AI 模型。該模型針對金融、法律及程式開發工作流程進行了優化,旨在與 Anthropic 和 OpenAI 競爭。

DeepReinforce 推出了全新的 Ornith-1.0 開源程式碼模型系列。該模型具備編寫自我強化學習 (RL) 架構的能力,並在程式碼基準測試中達到與 Claude Opus 4.7 相當的效能。
四名大學輟學生開發了一款在全球程式設計師中廣受歡迎的AI工具,最終以600億美元的價格被Elon Musk收購。

Z.ai 推出了 GLM-5.2,這是一款擁有 7,530 億參數的開源權重模型,專為長跨度編碼任務進行了優化。該模型具備 100 萬 token 的上下文窗口,並採用全新的 IndexShare 架構,大幅降低了運算成本。

月之暗面(Moonshot AI)發布並開源了 Kimi K2.7 Code 程式模型,顯著提升了長上下文指令遵循能力與程式編寫效能。相比前代 K2.6 模型,該模型平均 token 消耗減少了 30%。

Anthropic 發布了 Claude Opus 4.8,在編碼、推理及智能體任務可靠性方面均有提升。此次更新還引入了用於多智能體協作的「動態工作流」以及用於調整推理強度的控制項。