📲較早收集於 18h

OpenAI 推出 GPT-5.4 mini 和 nano 模型

OpenAI 推出 GPT-5.4 mini 和 nano 模型
PostLinkedIn
📲閱讀原文: Digital Trends

💡OpenAI更廉價、更快的GPT-5.4變體匹敵旗艦效能—完美即時開發(22字)

⚡ 30-Second TL;DR

有什麼變化

GPT-5.4 mini/nano 降低成本與延遲

為什麼重要

這些緊湊模型實現邊緣與即時AI部署的成本效益擴展。它們降低開發者建置延遲敏感應用程式的門檻,無需犧牲效能。

下一步行動

測試 OpenAI GPT-5.4 mini API,用於即時應用推論,延遲可降至50%。

誰應關注:Developers & AI Engineers

關鍵要點

  • GPT-5.4 mini/nano 降低成本與延遲
  • 效能接近旗艦模型
  • 最適合開發者即時應用程式

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 7 個來源。

🔑 增強重點摘要

  • GPT-5.4 mini 在 SWE-Bench Pro 基準測試得分 54.4%,接近旗艦 GPT-5.4 的 57.7%,並在 OSWorld-Verified 得分 72.1%[1][3]
  • GPT-5.4 nano 定價為輸入 $0.20/百萬 token、輸出 $1.25/百萬 token,支援 400,000 上下文視窗及圖像輸入[4]
  • 這些模型支援 Chat Completions、函數呼叫、結構化輸出及串流,nano 適用於分類、資料提取及子代理任務[4][1]
  • GPT-5.4 mini 在 ChatGPT 中對免費及 Go 用戶透過「Thinking」功能可用,對其他用戶作為 GPT-5.4 的速率限制後備[1]
  • 模型提升了代理式工作流程及電腦使用能力,如快速解讀 UI 螢幕截圖[2][3]

🛠️ 技術深入

  • GPT-5.4 nano:輸入 $0.20/百萬 token、快取輸入 $0.02/百萬 token、輸出 $1.25/百萬 token;上下文視窗 400,000 token、最大輸出 128,000 token;知識截止 2025-08-31[4]
  • 支援模態:文字輸入/輸出、圖像輸入;不支援音頻/影片[4]
  • 功能:串流、函數呼叫、結構化輸出、可微調;端點包括 Chat Completions、Responses 等[4]
  • 速率限制依階層:Tier 1 為 RPM 500、TPM 200,000 等[4]
  • GPT-5.4 mini 在 SWE-Bench Pro 54.4%、OSWorld-Verified 72.1%,比 GPT-5 mini 提升顯著(SWE-Bench Pro 從 45.7%)[1][3]

🔮 前景展望AI analysis grounded in cited sources

小型模型將主導多模型代理架構
GPT-5.4 mini 和 nano 驗證了使用廉價快速模型處理子任務的策略,提升代理工作流程效率而無需依賴昂貴旗艦模型[3][2]
即時應用程式開發加速
模型 2x 速度提升及接近旗艦效能,使開發者能建構高容量、低延遲的 AI 代理及電腦使用應用[1][5]
API 成本大幅降低
nano 的 $0.20/百萬輸入 token 定價適合分類及路由任務,擴大中小型開發者的採用[4][3]

時間線

2026-02
OpenAI 發布 Codex Mac 開發應用程式
2026-03
OpenAI 發布 GPT-5.3 Instant
2026-03
OpenAI 發布 GPT-5.4 Thinking,包含六項關鍵改進
2026-03
OpenAI 推出 GPT-5.4 旗艦模型,OSWorld-Verified 得分 75.0%
2026-03
OpenAI 發布 GPT-5.4 mini 和 nano 模型
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Digital Trends

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。