⚛️量子位•較早收集於 67m
Claude Fable 5 正式發布:首日實測表現驚人

💡Claude Fable 5 正式發布並獲得高度評價,立即確認它是否能超越您目前的 LLM 技術堆疊。
⚡ 30-Second TL;DR
有什麼變化
Claude Fable 5 在性能上較前代版本有顯著提升。
為什麼重要
Claude Fable 5 的發布可能會改變大型語言模型的競爭格局,並對現有的基準測試構成挑戰。開發者應評估其與目前生產環境模型相比的性能表現。
下一步行動
註冊 Anthropic API 並使用您現有的評估套件對 Claude Fable 5 進行基準測試,以評估其性能表現。
誰應關注:Developers & AI Engineers
關鍵要點
- •Claude Fable 5 在性能上較前代版本有顯著提升。
- •社群對該模型的初期反饋極為正面。
- •該模型現已開放測試與整合使用。
🧠 深度解析
Web-grounded analysis with 15 cited sources.
🔑 增強重點摘要
- •Claude Fable 5 是一款「神話級」(Mythos-class)模型,其核心能力與先前因網路安全疑慮而受限的 Claude Mythos 5 相同,但Fable 5已整合了嚴格的安全防護措施以供大眾使用。
- •該模型在軟體工程、知識工作、視覺處理和科學研究等多個領域展現出最先進的性能,在多項基準測試中顯著超越了前代模型 Claude Opus 4.8 以及競爭對手 GPT-5.5 和 Gemini 3.1 Pro。
- •Claude Fable 5 擁有 100 萬個 token 的上下文視窗和 128,000 個 token 的最大輸出限制,支援長時間自主運作、自我驗證和子代理協調,能夠處理多日期的複雜專案。
- •Fable 5 的定價為每百萬輸入 token 10 美元,每百萬輸出 token 50 美元,雖然比 Claude Mythos Preview 的價格低了一半以上,但仍屬於全球主要 AI 模型中較昂貴的選項。
- •Anthropic 透過與 Microsoft Foundry、Amazon Bedrock 和 Databricks 等主要雲端平台合作,確保 Claude Fable 5 的廣泛可用性,使其能夠整合到企業工作流程和開發者工具中。
📊 競品分析▸ Show
Anthropic 的 Claude Fable 5 在多項基準測試中展現出領先性能,尤其在複雜的代理任務和知識工作方面。以下是與主要競爭對手的比較:
| 特性/基準測試 | Claude Fable 5 / Mythos 5 | GPT-5.5 | Gemini 3.1 Pro | Claude Opus 4.8 |
|---|---|---|---|---|
| SWE-Bench Pro (軟體工程) | 80.3% | 58.6% | N/A | N/A |
| GDPval-AA (通用代理能力) | 1932 | 1769 | 1314 | 1890 |
| GDPpdf (視覺文件推理) | 29.8% (無工具) | 24.9% | 16.7% | 22.5% |
| FrontierCode (Diamond) (困難編碼任務) | 29.3% | 5.7% | N/A | 13.4% |
| Hebbia's Finance Benchmark (高階金融推理) | 最高分 | N/A | N/A | N/A |
| 定價 (每百萬輸入/輸出 token) | $10 / $50 | N/A | N/A | N/A |
註: Fable 5 的定價被認為是全球主要 AI 模型中最高的之一。由於缺乏直接的公開定價數據,此處未列出競爭對手的具體價格。
🛠️ 技術深入
- 模型類別: Claude Fable 5 屬於 Anthropic 的「神話級」(Mythos-class)模型,是其最強大的模型系列,與 Claude Mythos 5 共享相同的底層能力。
- 上下文視窗: 支援 100 萬個 token 的超大上下文視窗,能夠處理極長的輸入和複雜的任務。
- 最大輸出: 最大輸出 token 數為 128,000。
- 知識截止日期: 模型的知識截止日期為 2026 年 1 月。
- 多模態能力: 支援文字、圖像和檔案輸入,能夠理解圖表、示意圖和複雜表格等視覺及結構化資訊,並從螢幕截圖重建網頁應用程式的原始碼。
- 自主代理能力: 具備長週期自主性,能夠獨立規劃多階段任務、追蹤依賴關係並繞過障礙,減少人工干預。
- 自我驗證: 模型能夠編寫自己的測試來檢查程式碼,並利用視覺能力根據原始設計或目標驗證輸出結果。
- 子代理協調: 在代理框架中運行時,Fable 5 可以協調多個子代理,並在多日專案中保持上下文一致性。
- 安全防護: Fable 5 內建強大的安全防護措施,旨在確保普遍使用的安全性。在某些敏感主題的查詢上,模型會自動回退到 Claude Opus 4.8 以提供回應。
🔮 前景展望AI analysis grounded in cited sources
Claude Fable 5 的發布將顯著加劇前沿 AI 模型市場的競爭,特別是在企業級應用領域。
其在編碼、知識工作和視覺處理方面的卓越性能,以及強大的代理能力,使其成為複雜企業工作流程的有力競爭者,對現有市場領導者構成挑戰。
Anthropic 採用的「神話級」雙版本發布策略(Fable 5 的普遍可用性和 Mythos 5 的受限訪問)將成為部署高能力、潛在風險 AI 模型的新範式。
這種策略允許 Anthropic 在廣泛普及和負責任部署強大 AI 之間取得平衡,尤其是在網路安全等敏感領域。
該模型先進的自主代理能力將加速各行業中複雜、多日任務的 AI 代理開發和採用。
Fable 5 規劃、自我驗證和協調子代理以執行長期專案的能力,大幅減少了對人工干預的需求,從而實現了更高層次的自動化。
⏳ 時間線
2021-01
Anthropic 成立,由前 OpenAI 研究人員創立,專注於 AI 安全研究。
2023-03
Anthropic 發布其首個大型語言模型 Claude 1.0,並開放 API 供早期合作夥伴使用。
2023-07
Anthropic 發布 Claude 2.0,提升了性能、上下文視窗,並首次向美國和英國公眾開放聊天體驗。
2024-03
Anthropic 推出 Claude 3 系列模型(Opus、Sonnet、Haiku),引入多模態能力,並在多項基準測試中樹立新標準。
2025-05
Anthropic 發布 Claude 4 系列模型(Opus、Sonnet),並推出專為編碼任務設計的代理工具 Claude Code。
2026-06
Anthropic 正式發布 Claude Fable 5,一個具備強大防護措施的「神話級」模型,並廣泛開放測試與整合使用。
📎 來源 (15)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 量子位 ↗