💻較早收集於 22m

OpenAI GPT-5.4 mini nano 推出

OpenAI GPT-5.4 mini nano 推出
PostLinkedIn
💻閱讀原文: ZDNet AI
#small-models#benchmarks#inference-efficiencygpt-5.4-mini-and-nanoopenaigpt-5.4-minigpt-5.4-nanogpt-5.4

💡接近 GPT-5.4 效能、更低成本/更快速度 – 生產 AI 遊戲規則改變者。(42字元)

⚡ 30-Second TL;DR

有什麼變化

GPT-5.4 mini 接近旗艦基準測試

為什麼重要

降低生產擴展 AI 門檻,偏好高效模型而非巨型模型。加速開發者和新創成本效益採用。

下一步行動

透過 OpenAI API 基準測試 GPT-5.4 mini,用於延遲敏感應用。

誰應關注:Developers & AI Engineers

關鍵要點

  • GPT-5.4 mini 接近旗艦基準測試
  • 運行效能大幅加快
  • 高能力推理成本降低
  • 實現實際世界 AI 部署

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 9 個來源。

🔑 增強重點摘要

  • GPT-5.4 在 OSWorld-Verified 基準測試中達到 75.0% 成功率,超越人類專家基準 72.4%。[2][3]
  • GPT-5.4 引入原生電腦使用功能,能透過螢幕截圖、滑鼠和鍵盤直接操作軟體,無需外掛。[3][5]
  • GPT-5 nano API 定價為輸入 0.05 美元/百萬 token、輸出 0.40 美元/百萬 token,比 GPT-5 便宜 25 倍。[4]
  • GPT-5.4 影像輸入支援 original 細節等級,高達 1024 萬像素或 6000 像素最大尺寸,提升定位與理解準確度。[2]
📊 競品分析▸ Show
模型關鍵基準定價 (輸入/輸出 per 1M tokens)速度 (tokens/s)
GPT-5.4OSWorld 75.0%, GDPval 83%未詳 (旗艦)高輸出速度 [1]
GPT-5 nano高效小型任務$0.05 / $0.40 [4]極快 [1]
Gemini 3.1 ProARC-AGI-2 77.1% [5]未詳未詳
Claude Sonnet 4.6強編碼 [5]穩定低價 [5]未詳

🛠️ 技術深入

  • GPT-5.4 支援高解析影像輸入:original 等級達 10.24 百萬像素或 6000 像素最大邊長;high 等級 2.56 百萬像素。[2]
  • 上下文視窗:1M token (API/Codex),長上下文基準 Graphwalks BFS 0-128K 93.0%、256K-1M 21.4%;MRCR v2 8-needle 最高 97.2%。[2]
  • GPT-5 nano:輸入上下文 400K token,輸出上限 128K token,幻覺率 FactScore 7.3%。[4][9]
  • 原生電腦使用:透過螢幕截圖、鍵盤/滑鼠動作操作桌面,OSWorld-Verified 75.0%。[2][3]

🔮 前景展望AI analysis grounded in cited sources

小型模型將主導邊緣部署
GPT-5.4 mini/nano 基準接近旗艦但速度更快、成本更低,加速真實世界應用轉向高效模型。[1][3]
電腦使用代理將普及
GPT-5.4 原生支援螢幕操作超越人類基準,開發者可建構無外掛自主工作流。[3][5]
幻覺率降至商業可接受水準
GPT-5.4 比 GPT-5.2 減低 33% 重大事實錯誤,提升業務任務可靠性。[5]

時間線

2025-02
o3-mini-high 發布,提升推理強度與速度
2025-08
GPT-5 nano 早期版本推出,聚焦高效應用
2026-03
GPT-5.4 正式發布,引入原生電腦使用與基準領先
2026-03
GPT-5.4 mini 與 nano 隨旗艦推出,基準接近完整版
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ZDNet AI

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。