🍪Ben's Bites•較早收集於 2m
NVIDIA 與 Microsoft 合作推出 Opus 4.8

💡NVIDIA 與 Microsoft 在新運算平台上的重大合作,可能會改變 AI 基礎設施的產業標準。
⚡ 30-Second TL;DR
有什麼變化
Opus 4.8 是 NVIDIA 與 Microsoft 共同開發的新項目。
為什麼重要
此次合作可能會重新定義企業級 AI 基礎設施的標準。它很可能為開發者提供針對大規模模型訓練而優化的運算資源存取權。
下一步行動
請密切關注 Microsoft Azure 或 NVIDIA 的開發者部落格,以獲取關於如何將 Opus 4.8 整合至現有 AI 工作流程的文件。
誰應關注:Developers & AI Engineers
關鍵要點
- •Opus 4.8 是 NVIDIA 與 Microsoft 共同開發的新項目。
- •該項目突顯了兩家公司在 AI 基礎設施與運算領域的持續協同效應。
- •細節顯示其重點在於高效能運算或先進的模型架構。
🧠 深度解析
Web-grounded analysis with 20 cited sources.
🔑 增強重點摘要
- •Opus 4.8並非NVIDIA與Microsoft共同開發的模型,而是Anthropic推出的旗艦級大型語言模型(LLM),現已透過Microsoft Azure AI Foundry提供給開發者和企業使用,以支援複雜的編碼、代理任務和專業工作。
- •Opus 4.8在多項基準測試中展現卓越性能,例如在SWE-bench Pro編碼基準測試中得分69.2%,在「人類的最後一考」(Humanity's Last Exam)推理基準測試中,無論有無工具輔助,均領先GPT-5.5和Gemini 3.1 Pro。
- •NVIDIA與Microsoft的合作更側重於提供底層AI基礎設施,包括將NVIDIA Blackwell平台與Azure AI服務基礎設施整合,並在Azure AI Foundry中納入NVIDIA NIM微服務,以加速AI推論工作負載。
- •Opus 4.8引入了多項新功能,包括「努力控制」(effort control)讓用戶調整模型思考程度、Claude Code中的「動態工作流程」(dynamic workflows)以處理大規模問題,以及更經濟實惠的「快速模式」(fast mode),其價格比先前版本便宜三倍。
- •NVIDIA與Microsoft還合作推出了RTX Spark,這是一款專為Windows PC設計的全新系統單晶片(SoC),旨在提供安全的本地AI代理運行平台,結合Blackwell RTX GPU和Grace CPU,可實現高達1 petaflop的AI運算能力。
📊 競品分析▸ Show
| 特性/模型 | Claude Opus 4.8 (Anthropic) | GPT-5.5 (OpenAI) | Gemini 3.1 Pro (Google) |
|---|---|---|---|
| 發布日期 | 2026年5月28日 | (未明確提及,但作為比較對象) | (未明確提及,但作為比較對象) |
| 輸入價格 | 5美元/百萬輸入tokens | (未明確提及) | (未明確提及) |
| 輸出價格 | 25美元/百萬輸出tokens | (未明確提及) | (未明確提及) |
| 快速模式價格 | 10美元/百萬輸入tokens,50美元/百萬輸出tokens (比舊版便宜3倍) | (未明確提及) | (未明確提及) |
| 上下文視窗 | 100萬tokens | (GPT-5.5在1M token子集表現較差,暗示其上下文處理能力可能較弱) | (未明確提及) |
| SWE-bench Pro (編碼) | 69.2% (領先) | 58.6% | 54.2% |
| 人類的最後一考 (推理,無工具) | 49.8% (領先) | 41.4% | 44.4% |
| OSWorld-Verified (桌面控制) | 83.4% (領先) | 78.7% | (未明確提及) |
| MCP-Atlas (多步驟工具使用) | 82.2% (領先) | 75.3% | (未明確提及) |
| GraphWalks (長上下文推理,1M token) | 68.1% (領先) | 45.4% | (未明確提及) |
| 幻覺率 | 較低 (比Opus 4.7低四倍,更傾向於在不確定時棄權) | (未明確提及,但被Opus 4.8超越) | (未明確提及,但被Opus 4.8超越) |
| 主要優勢 | 高度自主代理、長程代理工作、複雜編碼、知識工作、多步驟推理、更誠實和自我校準。 | (專注於原始代理吞吐量和token效率) | (未明確提及) |
🛠️ 技術深入
- Claude Opus 4.8 模型架構與能力:
- 支援文字、圖像和檔案輸入,並輸出文字。
- 具備100萬token的上下文視窗和128,000 token的最大輸出長度。
- 專為高度自主代理、長程代理工作、知識工作和記憶驅動任務設計,在多步驟推理、複雜編碼和端到端專案協調方面表現出色。
- 引入「努力控制」功能,允許用戶選擇模型在任務中投入的思考程度。
- 支援「動態工作流程」,使Claude Code能夠處理非常大規模的問題。
- 訊息陣列現在接受對話中的系統訊息,允許在不破壞提示快取的情況下更新指令。
- NVIDIA與Microsoft的AI基礎設施整合:
- Microsoft Azure AI服務基礎設施整合了最新的NVIDIA Blackwell平台。
- Azure AI Foundry提供NVIDIA NIM微服務,為二十多個流行的基礎模型提供優化的容器,加速生成式AI應用程式和代理的部署。
- Azure的AI超級運算基礎設施採用NVIDIA GB200 Grace Blackwell Superchips、NVIDIA NVLink Switch互連,支援單一NVLink域中多達72個NVIDIA Blackwell GPU。
- 整合最新的NVIDIA Quantum InfiniBand,可擴展至Azure上數萬個Blackwell GPU,提供比前幾代GPU兩倍的AI超級運算性能。
- NVIDIA Run:ai作為Kubernetes原生的AI編排平台,已在Microsoft Marketplace上線,可優化GPU利用率並管理AI工作負載。
- NVIDIA RTX Spark for Windows PC:
- 一款新的系統單晶片(SoC),結合了Blackwell RTX GPU和20核Grace CPU。
- 提供高達1 petaflop的AI運算能力,並支援高達128GB的統一記憶體。
- 能夠在設備上運行1200億參數的大型語言模型,並具有100萬token的上下文。
- 包含新的Windows安全原語和NVIDIA OpenShell運行時,以確保AI代理在本地設備上安全運行,並提供用戶對數據訪問的控制。
🔮 前景展望AI analysis grounded in cited sources
企業AI應用將加速普及。
Anthropic的Claude Opus 4.8在Microsoft Azure AI Foundry上的可用性,結合NVIDIA的強大基礎設施,將使企業更容易存取和部署先進的AI模型,從而加速各行業的AI轉型。
個人AI運算將迎來新時代。
NVIDIA與Microsoft合作推出RTX Spark,將AI代理原生引入Windows PC,這可能重新定義個人電腦,使其成為更強大、更注重隱私的個人AI運算中心。
AI模型的「誠實性」和「可信度」將成為關鍵競爭優勢。
Opus 4.8在誠實性和自我校準方面的顯著改進,特別是其在不確定時棄權的能力,預示著未來AI發展將更加重視模型的可靠性和可信賴性。
⏳ 時間線
2024-08
Microsoft Azure與NVIDIA AI整合,提供NVIDIA AI Enterprise軟體平台和Azure AI工具集,加速AI應用開發。
2025-03
Microsoft和NVIDIA宣布深化AI技術棧合作,將NVIDIA Blackwell平台與Azure AI服務基礎設施整合,並將NVIDIA NIM微服務納入Azure AI Foundry。
2025-06
Microsoft for Startups推出Catalysts計畫,結合Microsoft Azure和NVIDIA技術,支援新創公司加速AI模型訓練和部署。
2025-10
NVIDIA Run:ai在Microsoft Azure上正式推出,提供Kubernetes原生的AI編排平台,優化GPU利用率。
2025-11
NVIDIA、Microsoft和Anthropic宣布一項450億美元的合作,Anthropic將購買300億美元的Azure雲端運算容量,NVIDIA和Microsoft分別向Anthropic投資100億美元和50億美元。
2026-05-28
Anthropic發布Claude Opus 4.8,作為其旗艦級大型語言模型,並引入努力控制、動態工作流程等新功能。
2026-05-31
Claude Opus 4.8在Microsoft Foundry上線,供開發者和企業使用。
2026-06-01
NVIDIA與Microsoft宣布合作,透過NVIDIA RTX Spark將AI代理原生引入Windows PC,重新定義個人AI運算。
📎 來源 (20)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Ben's Bites ↗