⚛️較早收集於 69m

Claude Mythos 5 發布:一天內完成 5000 萬行程式碼

Claude Mythos 5 發布:一天內完成 5000 萬行程式碼
PostLinkedIn
⚛️閱讀原文: 量子位

💡程式碼生成能力的巨大飛躍:一天內完成 5000 萬行程式碼編寫。

⚡ 30-Second TL;DR

有什麼變化

Anthropic 正式發布 Claude Mythos 5 模型

為什麼重要

此發布大幅提高了 AI 輔助軟體工程的標準,有望將大型企業專案的開發週期從數月縮短至數天。

下一步行動

評估 Claude Mythos 5 在大規模重構任務中與您當前使用的程式碼 AI 代理的效能差異。

誰應關注:Developers & AI Engineers

關鍵要點

  • Anthropic 正式發布 Claude Mythos 5 模型
  • 展現了在大規模程式碼生成任務中的極致效率
  • 具備在 24 小時內處理 5000 萬行程式碼的能力

🧠 深度解析

Web-grounded analysis with 10 cited sources.

🔑 增強重點摘要

  • Claude Mythos 5 屬於「Mythos 級」模型,其能力層級超越 Opus 級,且與公開發布的 Claude Fable 5 共享相同的底層模型。
  • Mythos 5 專門提供給經審查的網路安全和生物學研究合作夥伴使用,在這些領域移除了安全防護措施;而 Fable 5 則是面向大眾的公開版本,內建強大的安全防護以防止濫用。
  • 在 Project Glasswing 期間,早期 Mythos 級模型 (Mythos Preview) 發現了超過一萬個高危或關鍵嚴重性漏洞,其中包括 OpenBSD 中存在 27 年的缺陷和 Firefox 中的 271 個漏洞,展現了自主漏洞發現和利用開發能力。
  • Mythos 5 在 SWE-bench Verified 基準測試中取得了 93.9% 的分數,這表明其在明確定義的任務上具備近乎完全自主的工程能力。
  • 該模型是透過專有數據組合進行訓練的,其中包括來自公共網路的資訊、私人數據集以及其他模型生成的合成數據,並利用名為 ClaudeBot 的網路爬蟲獲取訓練數據。
📊 競品分析▸ Show
模型/功能SWE-bench Verified (或相關)上下文視窗API 定價 (每百萬 token 輸入/輸出)主要優勢
Anthropic Claude Mythos 5 / Fable 593.9% (Mythos Preview)1M token$10 / $50自主漏洞發現、大規模程式碼遷移、強大代理能力、Fable 5 具備強大安全防護
Anthropic Claude Opus 4.887.6%1M token$15 / $75 (Opus 4.6)複雜規劃與協調、代理程式碼生成領導者
OpenAI GPT-5.588.7%1M+ token尚未公開 (限訂閱用戶)自主工作主力、細節豐富且一致、強大推理能力
Grok Build 0.182.7%256k token$2 / $15 (Grok 4)專為代理工程設計、無輸出限制、即時 X (Twitter) 數據
Google Gemini 3.1 Pro63.8%1M token$2 / $12推理能力領先 (94.3% GPQA)、多模態 (影片、音訊)

🛠️ 技術深入

  • Claude Fable 5 和 Claude Mythos 5 預設支援 1M token 的上下文視窗,並可處理高達 128k 輸出 token 的請求。
  • 模型採用專有數據組合進行訓練,其中包括來自公共網路的資訊、公共和私人數據集,以及其他模型生成的合成數據。
  • 訓練過程中使用了多種數據清洗和過濾方法,包括去重和分類,並利用名為 ClaudeBot 的通用網路爬蟲獲取公共網站的訓練數據。
  • Claude Fable 5 內建安全分類器,能夠檢測並拒絕某些敏感請求,例如與網路安全、生物學/化學或試圖「蒸餾」模型以構建競爭性 AI 模型相關的查詢,這些請求會被重新導向至 Claude Opus 4.8。
  • Claude Mythos 5 是與 Claude Fable 5 相同的底層模型,但為經審查的合作夥伴在特定領域(如網路安全和生物學研究)移除了安全防護措施。
  • 模型支援多種功能,包括「Effort」(任務預算)、「記憶工具」、「透過上下文編輯清除工具結果」、「壓縮」和「視覺」。
  • Mythos 級模型在能力上超越了 Anthropic 的 Opus 級模型。
  • Mythos 5 展現了高度自主的操作能力,包括對自身工作的反思和驗證。

🔮 前景展望AI analysis grounded in cited sources

AI 模型如 Mythos 5 將從根本上改變軟體開發和網路安全實踐。
其自主發現和利用漏洞的能力,以及在數天內完成大規模程式碼遷移的能力,預示著從 AI 輔助向自主 AI 工程的轉變。
針對高能力 AI 模型,雙重發布策略(Mythos 5 供經審查的合作夥伴使用,Fable 5 帶有安全防護供大眾使用)將成為標準。
這種方法在實現創新與風險緩解之間取得平衡,允許在安全措施下進行受控部署,同時擴大更廣泛的訪問。
Anthropic 對「憲法式 AI」和強大安全防護的關注,對於維持信任和防止先進 AI 濫用至關重要。
Fable 5 內建分類器的明確設計以及持續改進安全防護的努力,突顯了公司在負責任 AI 開發方面的承諾,尤其考慮到模型在敏感領域的強大能力。

時間線

2021-01
Anthropic 成立,由前 OpenAI 研究人員創立,專注於 AI 安全。
2023-03
Claude 1 和 Claude Instant 公開發布。
2024-03
Claude 3 系列模型(Haiku、Sonnet、Opus)發布,引入多模態輸入和擴展上下文視窗。
2025-02
Claude Code 命令行工具發布預覽版。
2026-04-07
Anthropic 宣布 Project Glasswing,並向有限合作夥伴發布 Claude Mythos Preview。
2026-06-09
Claude Fable 5 (公開版) 和 Claude Mythos 5 (有限訪問版) 正式發布。

📎 來源 (10)

Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.

  1. anthropic.com
  2. anthropic.com
  3. forbes.com
  4. reddit.com
  5. cloudsecurityalliance.org
  6. anthropic.com
  7. claude.com
  8. kilo.ai
  9. logrocket.com
  10. gurusup.com
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 量子位