⚛️量子位•較早收集於 69m
Claude Mythos 5 發布:一天內完成 5000 萬行程式碼

💡程式碼生成能力的巨大飛躍:一天內完成 5000 萬行程式碼編寫。
⚡ 30-Second TL;DR
有什麼變化
Anthropic 正式發布 Claude Mythos 5 模型
為什麼重要
此發布大幅提高了 AI 輔助軟體工程的標準,有望將大型企業專案的開發週期從數月縮短至數天。
下一步行動
評估 Claude Mythos 5 在大規模重構任務中與您當前使用的程式碼 AI 代理的效能差異。
誰應關注:Developers & AI Engineers
關鍵要點
- •Anthropic 正式發布 Claude Mythos 5 模型
- •展現了在大規模程式碼生成任務中的極致效率
- •具備在 24 小時內處理 5000 萬行程式碼的能力
🧠 深度解析
Web-grounded analysis with 10 cited sources.
🔑 增強重點摘要
- •Claude Mythos 5 屬於「Mythos 級」模型,其能力層級超越 Opus 級,且與公開發布的 Claude Fable 5 共享相同的底層模型。
- •Mythos 5 專門提供給經審查的網路安全和生物學研究合作夥伴使用,在這些領域移除了安全防護措施;而 Fable 5 則是面向大眾的公開版本,內建強大的安全防護以防止濫用。
- •在 Project Glasswing 期間,早期 Mythos 級模型 (Mythos Preview) 發現了超過一萬個高危或關鍵嚴重性漏洞,其中包括 OpenBSD 中存在 27 年的缺陷和 Firefox 中的 271 個漏洞,展現了自主漏洞發現和利用開發能力。
- •Mythos 5 在 SWE-bench Verified 基準測試中取得了 93.9% 的分數,這表明其在明確定義的任務上具備近乎完全自主的工程能力。
- •該模型是透過專有數據組合進行訓練的,其中包括來自公共網路的資訊、私人數據集以及其他模型生成的合成數據,並利用名為 ClaudeBot 的網路爬蟲獲取訓練數據。
📊 競品分析▸ Show
| 模型/功能 | SWE-bench Verified (或相關) | 上下文視窗 | API 定價 (每百萬 token 輸入/輸出) | 主要優勢 |
|---|---|---|---|---|
| Anthropic Claude Mythos 5 / Fable 5 | 93.9% (Mythos Preview) | 1M token | $10 / $50 | 自主漏洞發現、大規模程式碼遷移、強大代理能力、Fable 5 具備強大安全防護 |
| Anthropic Claude Opus 4.8 | 87.6% | 1M token | $15 / $75 (Opus 4.6) | 複雜規劃與協調、代理程式碼生成領導者 |
| OpenAI GPT-5.5 | 88.7% | 1M+ token | 尚未公開 (限訂閱用戶) | 自主工作主力、細節豐富且一致、強大推理能力 |
| Grok Build 0.1 | 82.7% | 256k token | $2 / $15 (Grok 4) | 專為代理工程設計、無輸出限制、即時 X (Twitter) 數據 |
| Google Gemini 3.1 Pro | 63.8% | 1M token | $2 / $12 | 推理能力領先 (94.3% GPQA)、多模態 (影片、音訊) |
🛠️ 技術深入
- Claude Fable 5 和 Claude Mythos 5 預設支援 1M token 的上下文視窗,並可處理高達 128k 輸出 token 的請求。
- 模型採用專有數據組合進行訓練,其中包括來自公共網路的資訊、公共和私人數據集,以及其他模型生成的合成數據。
- 訓練過程中使用了多種數據清洗和過濾方法,包括去重和分類,並利用名為 ClaudeBot 的通用網路爬蟲獲取公共網站的訓練數據。
- Claude Fable 5 內建安全分類器,能夠檢測並拒絕某些敏感請求,例如與網路安全、生物學/化學或試圖「蒸餾」模型以構建競爭性 AI 模型相關的查詢,這些請求會被重新導向至 Claude Opus 4.8。
- Claude Mythos 5 是與 Claude Fable 5 相同的底層模型,但為經審查的合作夥伴在特定領域(如網路安全和生物學研究)移除了安全防護措施。
- 模型支援多種功能,包括「Effort」(任務預算)、「記憶工具」、「透過上下文編輯清除工具結果」、「壓縮」和「視覺」。
- Mythos 級模型在能力上超越了 Anthropic 的 Opus 級模型。
- Mythos 5 展現了高度自主的操作能力,包括對自身工作的反思和驗證。
🔮 前景展望AI analysis grounded in cited sources
AI 模型如 Mythos 5 將從根本上改變軟體開發和網路安全實踐。
其自主發現和利用漏洞的能力,以及在數天內完成大規模程式碼遷移的能力,預示著從 AI 輔助向自主 AI 工程的轉變。
針對高能力 AI 模型,雙重發布策略(Mythos 5 供經審查的合作夥伴使用,Fable 5 帶有安全防護供大眾使用)將成為標準。
這種方法在實現創新與風險緩解之間取得平衡,允許在安全措施下進行受控部署,同時擴大更廣泛的訪問。
Anthropic 對「憲法式 AI」和強大安全防護的關注,對於維持信任和防止先進 AI 濫用至關重要。
Fable 5 內建分類器的明確設計以及持續改進安全防護的努力,突顯了公司在負責任 AI 開發方面的承諾,尤其考慮到模型在敏感領域的強大能力。
⏳ 時間線
2021-01
Anthropic 成立,由前 OpenAI 研究人員創立,專注於 AI 安全。
2023-03
Claude 1 和 Claude Instant 公開發布。
2024-03
Claude 3 系列模型(Haiku、Sonnet、Opus)發布,引入多模態輸入和擴展上下文視窗。
2025-02
Claude Code 命令行工具發布預覽版。
2026-04-07
Anthropic 宣布 Project Glasswing,並向有限合作夥伴發布 Claude Mythos Preview。
2026-06-09
Claude Fable 5 (公開版) 和 Claude Mythos 5 (有限訪問版) 正式發布。
📎 來源 (10)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 量子位 ↗