📰較早收集於 1m

Anthropic 推出 Claude Opus 4.8,提升模型誠實度

Anthropic 推出 Claude Opus 4.8,提升模型誠實度
PostLinkedIn
📰閱讀原文: The Verge

💡邁向解決 AI 幻覺的重要一步;對於開發可靠、基於事實的應用程式的開發者至關重要。

⚡ 30-Second TL;DR

有什麼變化

Opus 4.8 做出無根據主張的可能性比前代降低了 4 倍。

為什麼重要

此更新解決了企業採用 AI 的關鍵瓶頸:信任與可靠性。透過減少「幻覺」,Anthropic 使該模型更適合高風險的專業工作流程。

下一步行動

將您目前的 RAG 流程與 Claude Opus 4.8 進行基準測試,觀察改進後的誠實度是否能減少對複雜驗證層的需求。

誰應關注:Developers & AI Engineers

關鍵要點

  • Opus 4.8 做出無根據主張的可能性比前代降低了 4 倍。
  • 該模型經過專門訓練,能主動標記不確定性,而非倉促下結論。
  • Anthropic 旨在解決 AI 模型過度自信地呈現薄弱證據的產業通病。

🧠 深度解析

Web-grounded analysis with 25 cited sources.

🔑 增強重點摘要

  • Claude Opus 4.8 保持與其前身 Opus 4.7 相同的定價結構,即每百萬輸入代幣 5 美元,每百萬輸出代幣 25 美元。
  • 新模型引入了「快速模式」,其速度比以前的快速模式快 2.5 倍,成本降低了三倍,儘管「降低三倍」的確切基準(是與舊的溢價相比還是與標準定價相比)需要進一步澄清。
  • Opus 4.8 在「電腦使用」和「瀏覽器代理」任務方面表現出顯著改進,在 Online-Mind2Web 基準測試中得分 84%,超越了 Opus 4.7 和 GPT-5.5。
  • 該模型在 Anthropic 的法律代理基準測試中也獲得最高分,首次在所有通過標準上突破 10%,表明在實質性法律工作方面的準確性有所提升。
  • Claude Code 引入了新的「動態工作流程」功能,使其能夠處理大規模問題,並且 claude.ai 上的用戶現在可以控制 Claude 在任務中投入的精力。
📊 競品分析▸ Show
特性/模型Claude Opus 4.8Claude Opus 4.7Claude Sonnet 4.6GPT-5.5Gemini 3.1 Pro
主要焦點減少幻覺、標記不確定性、電腦/瀏覽器代理、法律代理降低幻覺率、高級軟體工程、複雜多步驟任務編碼、代理、知識工作、設計最高事實召回率,但幻覺率高整合 Google 搜尋/知識圖譜
無根據主張減少比前代降低 4 倍----
幻覺率 (AA-Omniscience)(未提供絕對值,但強調顯著降低)36% (當模型不知道時自信地編造答案)-86% (當模型不知道時自信地編造答案)50% (當模型不知道時自信地編造答案)
幻覺率 (BullshitBench v2)--3.0%55-65% 範圍55-65% 範圍
Online-Mind2Web 基準84%低於 Opus 4.8-低於 Opus 4.8-
法律代理基準首次突破 10% (all-pass 標準)----
輸入代幣定價 (每百萬)5 美元5 美元3 美元2 美元 (CometAPI 數據,GPT-5.4)-
輸出代幣定價 (每百萬)25 美元25 美元15 美元2 美元 (CometAPI 數據,GPT-5.4)-
快速模式2.5 倍速度,成本降低 3 倍6 倍定價溢價,2.5 倍速度 (舊版)---

🛠️ 技術深入

  • Anthropic 的模型,包括 Opus 4.8,是使用「憲法式 AI (Constitutional AI)」原則進行訓練的,該方法透過一套原則或「憲法」來引導 AI,而非僅依賴人類回饋。
  • 憲法式 AI 訓練過程包括監督式學習階段(自我批評和修正)和使用偏好模型作為獎勵訊號的強化學習階段(來自 AI 回饋的強化學習 - RLAIF)。
  • 憲法已不斷演進;2026 年 1 月發布了一個顯著更新的版本,從基於規則的 AI 對齊轉向基於推理的 AI 對齊,解釋了倫理原則背後的邏輯,而非僅規定具體行為。
  • 新的憲法確立了四層優先級層次:安全、倫理、合規和實用性。
  • 減少幻覺的技術包括明確允許 Claude 說「我不知道」、要求其引用來源進行驗證,以及強制其使用直接引文作為事實依據。這些可以透過系統提示實現。
  • Opus 4.8 被描述為具有「更敏銳的判斷力」和「對自身進度更誠實」,以及「更好的推理、更徹底的問題解決、更好地處理不清楚或混亂的請求、更好地執行長時間運行的代理任務」。
  • Claude Code 的「動態工作流程」功能暗示了先進的代理能力和協調。

🔮 前景展望AI analysis grounded in cited sources

Anthropic 對誠實度和不確定性標記的關注將為企業 AI 採用設定新的行業標準。
企業優先考慮可靠性和可信度,明確管理不確定性並減少幻覺的模型將在法律和金融分析等關鍵應用中獲得競爭優勢。
Opus 4.8 中的「快速模式」和「動態工作流程」將加速複雜 AI 代理的開發和部署。
代理任務的速度和成本效率的提高,結合增強的工作流程管理,將使開發人員能夠構建更複雜和可靠的 AI 驅動自動化。
Anthropic 不斷演進的憲法式 AI 框架將影響更廣泛的 AI 治理和倫理準則。
Claude 憲法的公開發布和詳細結構,特別是其向基於推理的對齊轉變以及對 AI 意識可能性的承認,為負責任的 AI 開發提供了具體模型。

時間線

2021
Anthropic 成立,專注於 AI 安全和憲法式 AI。
2022-12
Anthropic 發表「憲法式 AI:來自 AI 回饋的無害性」論文,介紹其訓練方法。
2023-03
Anthropic 推出其首個公開 AI 模型 Claude 1。
2024-03
Claude 3 系列模型(Haiku、Sonnet、Opus)發布,引入多層級模型架構。
2026-01
Anthropic 發布了大幅更新的 Claude「憲法」,從基於規則轉向基於推理的 AI 對齊。
2026-05-28
Anthropic 推出 Claude Opus 4.8,重點提升模型誠實度。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: The Verge