📰較早收集於 16m

Anthropic 發布具備增強安全性的 Claude Fable 5

PostLinkedIn
📰閱讀原文: New York Times Technology

💡Anthropic 的新旗艦模型提供了增強的安全性,但價格翻倍。這對您的技術堆疊來說值得嗎?

⚡ 30-Second TL;DR

有什麼變化

Claude Fable 5 是 Mythos AI 系列的最新版本。

為什麼重要

此發布顯示 Anthropic 對安全優先部署的承諾,可能為企業級 AI 樹立新的行業標準。然而,高昂的定價可能會迫使開發人員重新評估生產工作負載的成本效益比。

下一步行動

評估您當前的應用場景,以確定 Claude Fable 5 的安全性改進是否值得比現有模型高出兩倍的成本。

誰應關注:Enterprise & Security Teams

關鍵要點

  • Claude Fable 5 是 Mythos AI 系列的最新版本。
  • 該模型相較於先前版本更強調安全性功能。
  • 定價為該公司先前旗艦模型的兩倍。

🧠 深度解析

Web-grounded analysis with 24 cited sources.

🔑 增強重點摘要

  • Claude Fable 5 在軟體工程、知識工作、視覺和科學研究等領域表現出最先進的能力,其性能優勢隨任務長度和複雜性而增加。
  • 該模型引入了新的安全防護措施,可將某些查詢重新導向至 Anthropic 的次級模型 Claude Opus 4.8,這些防護措施經過保守調整以確保安全快速發布。
  • Anthropic 同步推出了 Claude Mythos 5,該模型使用與 Fable 5 相同的底層技術,但在某些領域取消了安全防護,主要供網路防禦者和基礎設施提供商使用,並透過 Project Glasswing 與美國政府合作部署。
  • Claude Fable 5 的定價為每百萬輸入 token 10 美元,每百萬輸出 token 50 美元,這比其前身 Claude Mythos Preview 的價格低了不止一半。
  • Anthropic 的核心安全方法是「憲法式 AI」(Constitutional AI),透過一套原則來引導 AI 系統的行為,使其更具幫助性、無害性和誠實性,並減少對大量人類回饋的依賴。
📊 競品分析▸ Show
特性/模型Anthropic Claude Fable 5OpenAI GPT-5 系列Google Gemini 3 Pro
主要優勢增強安全性、複雜推理、代理工作、領先的程式碼生成、長上下文工作流程生態系統廣度、全方位推理、互動式問題解決多模態應用、原生影音支援、最長上下文視窗 (2M tokens)、與 Google 生態系統深度整合
安全性重點憲法式 AI、嚴格的安全防護措施、虛擬機沙盒環境專注於負責任的 AI 開發,但具體機制未如 Anthropic 般強調專注於負責任的 AI 開發,但具體機制未如 Anthropic 般強調
定價 (每百萬 token)輸入 $10 / 輸出 $50GPT-4o 輸入 $2.50 / 輸出 $10 (GPT-5 系列可能更高)Gemini 2.5 Pro/Flash 具成本效益,Gemini 3 Pro 價格未明確列出,但通常具競爭力
上下文視窗100 萬 token (Opus 4.8)GPT-5.2 達 40 萬 token (推測)200 萬 token
基準測試Cognition's FrontierCode 評估中得分最高GPT-5.5 在 Super-Agent 基準測試中被 Opus 4.8 超越在多模態任務和大規模上下文任務中表現出色

🛠️ 技術深入

  • Anthropic 的核心安全方法是「憲法式 AI」(Constitutional AI),它透過一套自然語言原則來引導 AI 系統的行為,使其能夠自我評估並修正輸出,以實現幫助性、無害性和誠實性,從而減少對大量人類回饋的需求。
  • 憲法式 AI 透過自我監督和對抗性訓練等技術,將人類價值觀與 AI 系統對齊,並能提高模型透明度和可擴展性。
  • Claude Fable 5 引入了新的安全防護措施,這些措施能夠將某些被認為不安全的查詢重新導向至 Anthropic 的次級模型 Claude Opus 4.8 進行處理。
  • Anthropic 的 Claude 模型基於 Transformer 架構,並結合了監督式學習和人類回饋強化學習 (RLHF) 的修改版本,以提高效率和安全性。
  • 為了增強代理的安全性,Anthropic 的 Claude Cowork(桌面代理)在虛擬機內部運行每個任務,並使用資料夾範圍的存取權限作為安全邊界,以防止對主機系統的未經授權存取。
  • Anthropic 於 2024 年 11 月開源了 Model Context Protocol (MCP),這是一個用於 AI 代理與外部工具和資料源之間安全雙向連接的開放標準,旨在作為代理整合的通用連接器。
  • Claude Opus 4.8(Fable 5 之前的旗艦模型)具備「自適應思考」功能,可根據任務複雜度自動調整思考深度,並在 Claude Code 中支援「動態工作流程」以處理大規模問題。

🔮 前景展望AI analysis grounded in cited sources

Anthropic 將透過其增強的安全性功能和高階模型(如 Claude Fable 5)鞏固其在企業和政府應用中的地位。
Fable 5 的安全防護措施和 Mythos 5 與美國政府的合作表明了 Anthropic 在高風險、敏感應用領域的戰略重點。
儘管 Fable 5 的價格較高,但其在複雜任務和代理工作中的卓越性能將推動企業採用,尤其是在軟體工程和知識工作領域。
Fable 5 在 Cognition's FrontierCode 評估中取得最高分,並在 Stripe 的實際應用中展現了顯著的效率提升,證明了其價值。
Anthropic 對於 AI 安全和可控性的持續投入,例如憲法式 AI 和沙盒技術,將成為其在競爭激烈的 AI 市場中的主要差異化因素。
Anthropic 從成立之初就將 AI 安全和對齊視為核心,並透過憲法式 AI 和 Cowork 的虛擬機沙盒等技術來實現,這與其他公司形成鮮明對比。

時間線

2021-01
Anthropic 成立,旨在建立可靠、可解釋和可控的 AI 系統。
2022-12
發表「憲法式 AI:從 AI 回饋中實現無害性」研究論文,介紹其核心安全方法。
2023-03
發布首個 Claude 模型。
2023-09
亞馬遜宣布對 Anthropic 進行戰略投資,最初投資 12.5 億美元。
2025-09
完成 F 輪融資,籌集 130 億美元,投後估值達 1830 億美元。
2026-06-09
發布具備增強安全性的 Claude Fable 5 模型。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: New York Times Technology