來源較早收集於 86m

Anthropic 即將發布 Mythos 等級模型 Opus 4.8

閱讀原文: ITmedia AI+ (日本)
#anthropic#llm#model-release

準備迎接 Anthropic 的下一代旗艦模型,預計將帶來更強的效能與安全性提升。

30 秒速覽

有什麼變化

Opus 4.8 即將於數週內全面發布

為什麼重要

Opus 4.8 的發布代表 Anthropic 旗艦產品線的重大更新,極可能為企業級 AI 的效能與安全性樹立新標竿。

下一步行動

準備您的 API 整合工作流程,以便在 Anthropic Console 上線後立即測試 Opus 4.8。

誰應關注:Developers & AI Engineers

關鍵要點

  • Opus 4.8 即將於數週內全面發布
  • 定位為 Mythos 等級的高效能模型
  • 強調在發布前已強化安全防護機制

深度解析

背景與延伸:來自公開資料,非原文內容。引用 42 個來源。

增強重點摘要

  • Opus 4.8 顯著提升了其在代理編碼、多學科推理、電腦使用和知識工作方面的能力,並在基準測試中取得新高分。
  • 該模型強調「更誠實」的AI回應,其讓編碼錯誤未被發現的可能性比前代Opus 4.7降低約四倍。
  • Opus 4.8 引入了「動態工作流程」功能(目前為Claude Code的研發預覽版),使其能夠規劃任務並在單一會話中運行數百個並行子代理,適用於大規模的程式碼庫遷移等任務。
  • 「Mythos 等級」模型具備識別系統和瀏覽器漏洞的網路安全能力,Anthropic此前曾認為此類模型過於危險不適合向公眾開放。
  • Opus 4.8 的快速模式成本降低了三倍,同時新增了「努力控制」功能,允許用戶調整模型回應的投入程度,以平衡品質與速率限制。

競品分析

定位
Anthropic Claude Opus 4.8
Mythos等級高效能模型,強調誠實、安全與代理能力
OpenAI GPT-4o / GPT-5.4
通用多模態模型,GPT-4o在多數基準測試中超越Claude 3 Opus;GPT-5.4在代理執行基準測試中領先
Google Gemini 1.5 Pro / 2.5 Flash
多模態模型,Gemini 1.5 Pro強調長上下文處理;Gemini 2.5 Flash為成本領先者
主要功能
Anthropic Claude Opus 4.8
代理編碼、多學科推理、電腦使用、知識工作、動態工作流程、強化安全防護
OpenAI GPT-4o / GPT-5.4
多模態輸入(文本、圖像、音訊、視訊),即時語音對話,高效能
Google Gemini 1.5 Pro / 2.5 Flash
長上下文窗口(1M tokens),多模態理解,高效能
安全機制
Anthropic Claude Opus 4.8
憲法式AI (Constitutional AI),強調倫理對齊、低幻覺率、減少編碼錯誤
OpenAI GPT-4o / GPT-5.4
具備安全與對齊機制,但有時傾向「冒險作答」
Google Gemini 1.5 Pro / 2.5 Flash
具備安全與對齊機制,中規中矩但可靠
基準表現
Anthropic Claude Opus 4.8
在編碼、代理任務、推理和知識工作方面取得新高分;Claude 3 Opus曾超越GPT-4
OpenAI GPT-4o / GPT-5.4
GPT-4o在多數可重複開源評估中超越Claude 3 Opus;GPT-5.4在代理執行基準測試中領先
Google Gemini 1.5 Pro / 2.5 Flash
Gemini Ultra在某些數學和編碼基準測試中表現良好,但整體不如Claude 3 Opus
定價 (每百萬tokens)
Anthropic Claude Opus 4.8
標準模式: 輸入 $5.00, 輸出 $25.00 (參考Opus 4.7);快速模式: 輸入 $10.00, 輸出 $50.00
OpenAI GPT-4o / GPT-5.4
GPT-4o: 輸入 $5.00, 輸出 $15.00 (參考發布時價格)
Google Gemini 1.5 Pro / 2.5 Flash
Gemini 1.5 Pro: 輸入 $7.00, 輸出 $21.00 (參考發布時價格)
上下文窗口
Anthropic Claude Opus 4.8
200K tokens (Claude 3 Opus);部分Claude 4.x模型支持1M tokens
OpenAI GPT-4o / GPT-5.4
128K tokens (GPT-4o)
Google Gemini 1.5 Pro / 2.5 Flash
1M tokens (Gemini 1.5 Pro)

技術深入

  • Claude 3 系列模型(包括Opus)是大型多模態模型,具備複雜的視覺處理能力,可處理照片、圖表、圖形和技術圖表等視覺輸入。
  • 模型採用無監督學習和「憲法式AI」(Constitutional AI) 方法進行訓練,以提升倫理和法律合規性,減少偏見並增強安全性。
  • 訓練硬體主要使用Amazon Web Services (AWS) 和Google Cloud Platform (GCP),並採用PyTorch、JAX 和Triton 等核心框架。
  • 訓練數據來源包括截至2023年8月的公開網路數據、數據標註服務的公開數據以及內部生成的合成數據,並經過去重和分類等數據清洗和過濾處理。
  • Anthropic明確表示模型不會使用用戶提交的提示或輸出數據進行訓練。
  • Opus 4.8 引入了「動態工作流程」功能,使其能夠規劃任務並在單一會話中運行數百個並行子代理,旨在處理大規模任務。
  • 新增的「努力控制」功能允許用戶調整模型在回應時的「思考」頻率和深度,以平衡回應品質和速度限制。

前景展望基於引用來源的 AI 分析

Anthropic將進一步鞏固其在企業級AI市場的領導地位。
Opus 4.8的強化安全措施、代理能力和「誠實」特性,特別是其「Mythos等級」的網路安全能力,使其成為對安全性要求高的企業客戶的理想選擇。
AI模型在自主代理和複雜任務規劃方面的能力將加速發展。
Opus 4.8引入的「動態工作流程」和運行多個子代理的能力,預示著AI系統將能更自主地執行大規模、多步驟的複雜任務。
AI模型「誠實度」和「可信賴性」將成為業界新的競爭焦點。
Anthropic特別強調Opus 4.8在減少編碼錯誤和提高「誠實度」方面的進步,這將促使其他AI開發者也投入更多資源來提升模型的可靠性和透明度。

時間線

2021-02
Anthropic 公司成立
2023-03
Claude 1.0 模型首次發布
2024-03
Claude 3 模型家族 (Haiku, Sonnet, Opus) 推出,確立多層級產品策略並進入多模態領域
2024-06
Claude 3.5 Sonnet 發布,進一步提升性能
2026-04
Claude Opus 4.7 發布
2026-05
Anthropic 宣布即將全面發布 Mythos 等級模型 Opus 4.8,並已推出 Opus 4.8

來源 (42)

Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.

1techzine.euvertexaisearch.cloud.google.com2trendingtopics.euvertexaisearch.cloud.google.com3zdnet.comvertexaisearch.cloud.google.com4qz.comvertexaisearch.cloud.google.com5sina.com.cnvertexaisearch.cloud.google.com6jiemian.comvertexaisearch.cloud.google.com7yellow.comvertexaisearch.cloud.google.com8wikipedia.orgvertexaisearch.cloud.google.com9openai.comvertexaisearch.cloud.google.com10langbase.comvertexaisearch.cloud.google.com11mudassirkhan.mevertexaisearch.cloud.google.com12straico.comvertexaisearch.cloud.google.com13claude.comvertexaisearch.cloud.google.com14liweinlp.comvertexaisearch.cloud.google.com15feishu.cnvertexaisearch.cloud.google.com16aiposthub.comvertexaisearch.cloud.google.com17line.mevertexaisearch.cloud.google.com18abmedia.iovertexaisearch.cloud.google.com19ai-supremacy.comvertexaisearch.cloud.google.com20sbbit.jpvertexaisearch.cloud.google.com21metacto.comvertexaisearch.cloud.google.com22cloudprice.netvertexaisearch.cloud.google.com23teamai.comvertexaisearch.cloud.google.com24artificialanalysis.aivertexaisearch.cloud.google.com25llmpricecheck.comvertexaisearch.cloud.google.com26gitbook.iovertexaisearch.cloud.google.com27anthropic.comvertexaisearch.cloud.google.com28encord.comvertexaisearch.cloud.google.com29anthropic.comvertexaisearch.cloud.google.com30hidekazu-konishi.comvertexaisearch.cloud.google.com31feishu.cnvertexaisearch.cloud.google.com32llmmodels.orgvertexaisearch.cloud.google.com33aliyun.comvertexaisearch.cloud.google.com34csdn.netvertexaisearch.cloud.google.com35volcengine.comvertexaisearch.cloud.google.com36paloaltoinsight.comvertexaisearch.cloud.google.com37tencent.comvertexaisearch.cloud.google.com38acesinc.co.jpvertexaisearch.cloud.google.com39moneyforward.comvertexaisearch.cloud.google.com40impress.co.jpvertexaisearch.cloud.google.com41wikipedia.orgvertexaisearch.cloud.google.com42axios.comvertexaisearch.cloud.google.com

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ITmedia AI+ (日本)

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。