
Fable 5:透過「Make it better」實現 AI Agentic Coding
Fable 5 演示展示了 AI Agent 如何透過「Make it better」等模糊指令進行長期迭代開發。這標誌著從一次性程式碼生成轉向具備狀態感知與持續維護能力的 Agentic Coding。
Tag: #software-engineering63 results

Fable 5 演示展示了 AI Agent 如何透過「Make it better」等模糊指令進行長期迭代開發。這標誌著從一次性程式碼生成轉向具備狀態感知與持續維護能力的 Agentic Coding。

Anthropic 的 Claude Code 顯著提升了工程生產力,將主要瓶頸從編寫程式碼轉移到定義產品需求。隨著 AI 處理實作細節,開發者必須轉型為以產品為導向的思考者才能保持競爭力。

OpenAI 報告稱,其 98% 的員工已從使用標準聊天機器人轉向使用 Codex AI 代理來執行編碼任務。該公司發表了一篇研究論文,詳細介紹了這種內部 AI 互動模式的轉變。

Xiaomi 研究人員推出了 HarnessX 框架,將 AI 軟體架構視為可組合物件,並能進行自動化優化。透過動態調整提示詞與工具整合,該框架顯著提升了 AI 效能,特別是在小型基礎模型上表現優異。

DeepSWE 是一個全新的開源基準測試,旨在評估前沿 AI 模型在真實軟體工程任務中的表現。它強調無污染的任務設計、高度的儲存庫多樣性以及基於軟體行為的驗證機制。

SpaceX 宣布以 600 億美元收購 AI 程式編輯器 Cursor 的開發商 Anysphere。此項策略性收購將先進的 AI 程式編寫能力整合進 Elon Musk 的科技版圖中。

本研究引入「交接債務」(handoff debt)概念,量化 AI 程式設計代理在接手未完成任務時的效率損失。實驗顯示,提供結構化上下文能顯著降低 Token 使用量與代理執行次數,優於僅提供原始儲存庫存取權。

Anthropic 推出最強一般可用模型 Claude Opus 4.7。它在進階軟體工程、複雜編碼、影像分析、指令遵循及創意文件生成表現優異。此更新緊隨 Mythos Preview 網路安全模型之後。

MiniMax 開源其 M2.7 模型,獲得多家全球晶片製造商與平台的支援。此舉旨在擴大於軟體工程及 AI 代理應用中的採用。模型完全免費,無定價機制。

Anthropic 研究顯示 AI 涵蓋 74.5% 程式員任務,導致全球初級編碼工作急劇下降。Nvidia 執行長比喻未來程式設計如打字,AI 架構師需求激增。矽谷開發者現將大多數編碼委託給 Claude Code 等 AI,大幅提升效率。