🗾較早收集於 86m

Anthropic 即將發布 Mythos 等級模型 Opus 4.8

Anthropic 即將發布 Mythos 等級模型 Opus 4.8
PostLinkedIn
🗾閱讀原文: ITmedia AI+ (日本)

💡準備迎接 Anthropic 的下一代旗艦模型,預計將帶來更強的效能與安全性提升。

⚡ 30-Second TL;DR

有什麼變化

Opus 4.8 即將於數週內全面發布

為什麼重要

Opus 4.8 的發布代表 Anthropic 旗艦產品線的重大更新,極可能為企業級 AI 的效能與安全性樹立新標竿。

下一步行動

準備您的 API 整合工作流程,以便在 Anthropic Console 上線後立即測試 Opus 4.8。

誰應關注:Developers & AI Engineers

關鍵要點

  • Opus 4.8 即將於數週內全面發布
  • 定位為 Mythos 等級的高效能模型
  • 強調在發布前已強化安全防護機制

🧠 深度解析

Web-grounded analysis with 42 cited sources.

🔑 增強重點摘要

  • Opus 4.8 顯著提升了其在代理編碼、多學科推理、電腦使用和知識工作方面的能力,並在基準測試中取得新高分。
  • 該模型強調「更誠實」的AI回應,其讓編碼錯誤未被發現的可能性比前代Opus 4.7降低約四倍。
  • Opus 4.8 引入了「動態工作流程」功能(目前為Claude Code的研發預覽版),使其能夠規劃任務並在單一會話中運行數百個並行子代理,適用於大規模的程式碼庫遷移等任務。
  • 「Mythos 等級」模型具備識別系統和瀏覽器漏洞的網路安全能力,Anthropic此前曾認為此類模型過於危險不適合向公眾開放。
  • Opus 4.8 的快速模式成本降低了三倍,同時新增了「努力控制」功能,允許用戶調整模型回應的投入程度,以平衡品質與速率限制。
📊 競品分析▸ Show
特性/模型Anthropic Claude Opus 4.8OpenAI GPT-4o / GPT-5.4Google Gemini 1.5 Pro / 2.5 Flash
定位Mythos等級高效能模型,強調誠實、安全與代理能力通用多模態模型,GPT-4o在多數基準測試中超越Claude 3 Opus;GPT-5.4在代理執行基準測試中領先多模態模型,Gemini 1.5 Pro強調長上下文處理;Gemini 2.5 Flash為成本領先者
主要功能代理編碼、多學科推理、電腦使用、知識工作、動態工作流程、強化安全防護多模態輸入(文本、圖像、音訊、視訊),即時語音對話,高效能長上下文窗口(1M tokens),多模態理解,高效能
安全機制憲法式AI (Constitutional AI),強調倫理對齊、低幻覺率、減少編碼錯誤具備安全與對齊機制,但有時傾向「冒險作答」具備安全與對齊機制,中規中矩但可靠
基準表現在編碼、代理任務、推理和知識工作方面取得新高分;Claude 3 Opus曾超越GPT-4GPT-4o在多數可重複開源評估中超越Claude 3 Opus;GPT-5.4在代理執行基準測試中領先Gemini Ultra在某些數學和編碼基準測試中表現良好,但整體不如Claude 3 Opus
定價 (每百萬tokens)標準模式: 輸入 $5.00, 輸出 $25.00 (參考Opus 4.7);快速模式: 輸入 $10.00, 輸出 $50.00GPT-4o: 輸入 $5.00, 輸出 $15.00 (參考發布時價格)Gemini 1.5 Pro: 輸入 $7.00, 輸出 $21.00 (參考發布時價格)
上下文窗口200K tokens (Claude 3 Opus);部分Claude 4.x模型支持1M tokens128K tokens (GPT-4o)1M tokens (Gemini 1.5 Pro)

🛠️ 技術深入

  • Claude 3 系列模型(包括Opus)是大型多模態模型,具備複雜的視覺處理能力,可處理照片、圖表、圖形和技術圖表等視覺輸入。
  • 模型採用無監督學習和「憲法式AI」(Constitutional AI) 方法進行訓練,以提升倫理和法律合規性,減少偏見並增強安全性。
  • 訓練硬體主要使用Amazon Web Services (AWS) 和Google Cloud Platform (GCP),並採用PyTorch、JAX 和Triton 等核心框架。
  • 訓練數據來源包括截至2023年8月的公開網路數據、數據標註服務的公開數據以及內部生成的合成數據,並經過去重和分類等數據清洗和過濾處理。
  • Anthropic明確表示模型不會使用用戶提交的提示或輸出數據進行訓練。
  • Opus 4.8 引入了「動態工作流程」功能,使其能夠規劃任務並在單一會話中運行數百個並行子代理,旨在處理大規模任務。
  • 新增的「努力控制」功能允許用戶調整模型在回應時的「思考」頻率和深度,以平衡回應品質和速度限制。

🔮 前景展望AI analysis grounded in cited sources

Anthropic將進一步鞏固其在企業級AI市場的領導地位。
Opus 4.8的強化安全措施、代理能力和「誠實」特性,特別是其「Mythos等級」的網路安全能力,使其成為對安全性要求高的企業客戶的理想選擇。
AI模型在自主代理和複雜任務規劃方面的能力將加速發展。
Opus 4.8引入的「動態工作流程」和運行多個子代理的能力,預示著AI系統將能更自主地執行大規模、多步驟的複雜任務。
AI模型「誠實度」和「可信賴性」將成為業界新的競爭焦點。
Anthropic特別強調Opus 4.8在減少編碼錯誤和提高「誠實度」方面的進步,這將促使其他AI開發者也投入更多資源來提升模型的可靠性和透明度。

時間線

2021-02
Anthropic 公司成立
2023-03
Claude 1.0 模型首次發布
2024-03
Claude 3 模型家族 (Haiku, Sonnet, Opus) 推出,確立多層級產品策略並進入多模態領域
2024-06
Claude 3.5 Sonnet 發布,進一步提升性能
2026-04
Claude Opus 4.7 發布
2026-05
Anthropic 宣布即將全面發布 Mythos 等級模型 Opus 4.8,並已推出 Opus 4.8
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ITmedia AI+ (日本)