🗾ITmedia AI+ (日本)•較早收集於 86m
Anthropic 即將發布 Mythos 等級模型 Opus 4.8

💡準備迎接 Anthropic 的下一代旗艦模型,預計將帶來更強的效能與安全性提升。
⚡ 30-Second TL;DR
有什麼變化
Opus 4.8 即將於數週內全面發布
為什麼重要
Opus 4.8 的發布代表 Anthropic 旗艦產品線的重大更新,極可能為企業級 AI 的效能與安全性樹立新標竿。
下一步行動
準備您的 API 整合工作流程,以便在 Anthropic Console 上線後立即測試 Opus 4.8。
誰應關注:Developers & AI Engineers
關鍵要點
- •Opus 4.8 即將於數週內全面發布
- •定位為 Mythos 等級的高效能模型
- •強調在發布前已強化安全防護機制
🧠 深度解析
Web-grounded analysis with 42 cited sources.
🔑 增強重點摘要
- •Opus 4.8 顯著提升了其在代理編碼、多學科推理、電腦使用和知識工作方面的能力,並在基準測試中取得新高分。
- •該模型強調「更誠實」的AI回應,其讓編碼錯誤未被發現的可能性比前代Opus 4.7降低約四倍。
- •Opus 4.8 引入了「動態工作流程」功能(目前為Claude Code的研發預覽版),使其能夠規劃任務並在單一會話中運行數百個並行子代理,適用於大規模的程式碼庫遷移等任務。
- •「Mythos 等級」模型具備識別系統和瀏覽器漏洞的網路安全能力,Anthropic此前曾認為此類模型過於危險不適合向公眾開放。
- •Opus 4.8 的快速模式成本降低了三倍,同時新增了「努力控制」功能,允許用戶調整模型回應的投入程度,以平衡品質與速率限制。
📊 競品分析▸ Show
| 特性/模型 | Anthropic Claude Opus 4.8 | OpenAI GPT-4o / GPT-5.4 | Google Gemini 1.5 Pro / 2.5 Flash |
|---|---|---|---|
| 定位 | Mythos等級高效能模型,強調誠實、安全與代理能力 | 通用多模態模型,GPT-4o在多數基準測試中超越Claude 3 Opus;GPT-5.4在代理執行基準測試中領先 | 多模態模型,Gemini 1.5 Pro強調長上下文處理;Gemini 2.5 Flash為成本領先者 |
| 主要功能 | 代理編碼、多學科推理、電腦使用、知識工作、動態工作流程、強化安全防護 | 多模態輸入(文本、圖像、音訊、視訊),即時語音對話,高效能 | 長上下文窗口(1M tokens),多模態理解,高效能 |
| 安全機制 | 憲法式AI (Constitutional AI),強調倫理對齊、低幻覺率、減少編碼錯誤 | 具備安全與對齊機制,但有時傾向「冒險作答」 | 具備安全與對齊機制,中規中矩但可靠 |
| 基準表現 | 在編碼、代理任務、推理和知識工作方面取得新高分;Claude 3 Opus曾超越GPT-4 | GPT-4o在多數可重複開源評估中超越Claude 3 Opus;GPT-5.4在代理執行基準測試中領先 | Gemini Ultra在某些數學和編碼基準測試中表現良好,但整體不如Claude 3 Opus |
| 定價 (每百萬tokens) | 標準模式: 輸入 $5.00, 輸出 $25.00 (參考Opus 4.7);快速模式: 輸入 $10.00, 輸出 $50.00 | GPT-4o: 輸入 $5.00, 輸出 $15.00 (參考發布時價格) | Gemini 1.5 Pro: 輸入 $7.00, 輸出 $21.00 (參考發布時價格) |
| 上下文窗口 | 200K tokens (Claude 3 Opus);部分Claude 4.x模型支持1M tokens | 128K tokens (GPT-4o) | 1M tokens (Gemini 1.5 Pro) |
🛠️ 技術深入
- Claude 3 系列模型(包括Opus)是大型多模態模型,具備複雜的視覺處理能力,可處理照片、圖表、圖形和技術圖表等視覺輸入。
- 模型採用無監督學習和「憲法式AI」(Constitutional AI) 方法進行訓練,以提升倫理和法律合規性,減少偏見並增強安全性。
- 訓練硬體主要使用Amazon Web Services (AWS) 和Google Cloud Platform (GCP),並採用PyTorch、JAX 和Triton 等核心框架。
- 訓練數據來源包括截至2023年8月的公開網路數據、數據標註服務的公開數據以及內部生成的合成數據,並經過去重和分類等數據清洗和過濾處理。
- Anthropic明確表示模型不會使用用戶提交的提示或輸出數據進行訓練。
- Opus 4.8 引入了「動態工作流程」功能,使其能夠規劃任務並在單一會話中運行數百個並行子代理,旨在處理大規模任務。
- 新增的「努力控制」功能允許用戶調整模型在回應時的「思考」頻率和深度,以平衡回應品質和速度限制。
🔮 前景展望AI analysis grounded in cited sources
Anthropic將進一步鞏固其在企業級AI市場的領導地位。
Opus 4.8的強化安全措施、代理能力和「誠實」特性,特別是其「Mythos等級」的網路安全能力,使其成為對安全性要求高的企業客戶的理想選擇。
AI模型在自主代理和複雜任務規劃方面的能力將加速發展。
Opus 4.8引入的「動態工作流程」和運行多個子代理的能力,預示著AI系統將能更自主地執行大規模、多步驟的複雜任務。
AI模型「誠實度」和「可信賴性」將成為業界新的競爭焦點。
Anthropic特別強調Opus 4.8在減少編碼錯誤和提高「誠實度」方面的進步,這將促使其他AI開發者也投入更多資源來提升模型的可靠性和透明度。
⏳ 時間線
2021-02
Anthropic 公司成立
2023-03
Claude 1.0 模型首次發布
2024-03
Claude 3 模型家族 (Haiku, Sonnet, Opus) 推出,確立多層級產品策略並進入多模態領域
2024-06
Claude 3.5 Sonnet 發布,進一步提升性能
2026-04
Claude Opus 4.7 發布
2026-05
Anthropic 宣布即將全面發布 Mythos 等級模型 Opus 4.8,並已推出 Opus 4.8
📎 來源 (42)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- techzine.eu
- trendingtopics.eu
- zdnet.com
- qz.com
- sina.com.cn
- jiemian.com
- yellow.com
- wikipedia.org
- openai.com
- langbase.com
- mudassirkhan.me
- straico.com
- claude.com
- liweinlp.com
- feishu.cn
- aiposthub.com
- line.me
- abmedia.io
- ai-supremacy.com
- sbbit.jp
- metacto.com
- cloudprice.net
- teamai.com
- artificialanalysis.ai
- llmpricecheck.com
- gitbook.io
- anthropic.com
- encord.com
- anthropic.com
- hidekazu-konishi.com
- feishu.cn
- llmmodels.org
- aliyun.com
- csdn.net
- volcengine.com
- paloaltoinsight.com
- tencent.com
- acesinc.co.jp
- moneyforward.com
- impress.co.jp
- wikipedia.org
- axios.com
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ITmedia AI+ (日本) ↗
