
GPT-5.6 Sol 價格下調 20% 至 33%
OpenAI 已將 GPT-5.6 Sol 的輸入 token 定價下調 20%,輸出 token 定價下調三分之一,涵蓋所有服務級別。Vercel 的 50% AI Gateway 折扣維持至 9 月 18 日,並會自動套用至新價格。
Tag: #reasoning-model14 results

OpenAI 已將 GPT-5.6 Sol 的輸入 token 定價下調 20%,輸出 token 定價下調三分之一,涵蓋所有服務級別。Vercel 的 50% AI Gateway 折扣維持至 9 月 18 日,並會自動套用至新價格。

OpenAI的通用推理模型成功解決了離散幾何領域的一個長期難題,標誌著AI驅動科學研究的重要里程碑。

據傳 Google 計劃於 7 月 17 日發布 Gemini 3.5 Pro,具備 200 萬 token 上下文窗口及全新的「深度思考」推理模式。早期測試顯示其在編碼任務與智能體工作流表現優於 Claude Fable 5。

Zyphra 發布 ZAYA1-8B,這是一個開放的 8B 參數混合專家推理模型,在 AMD Instinct MI300 GPU 上訓練,在基準測試中與 GPT-5-High 和 DeepSeek-V3.2 競爭。Apache 2.0 授權可在 Hugging Face 免費下載並自訂。它具備創新的 MoE++ 架構,提供優異效率。

哈佛一項試驗發現,OpenAI 的 o1 模型在緊急分診診斷上優於醫生。此結果展示 AI 作為醫院第二意見工具的潛力。此基準測試突顯其在關鍵醫療情境中的先進推理能力。

Anthropic 已針對即將推出的 Claude Mythos 模型啟動紅隊測試,該模型源自「Oceanus」檢查點。此模型旨在強化推理、程式編寫及網路安全任務的表現。

哈佛研究顯示基於 OpenAI o1 的 AI 在急診分診準確率超越醫生:67% 對 50-55%。更多資料時準確率升至 82%,治療計劃達 89% 而醫生僅 34%。研究者強調 AI 是輔助而非取代,因限於文字輸入。

OpenAI 推出 ChatGPT Images 2.0,大幅改善指令遵循、密集文字渲染,以及日文、韓文、中文、印地文和孟加拉文等非拉丁文字。模型新增推理能力,包括網路搜尋以確保輸出可靠,支持最大 3:1 或 1:3 長寬比、2K 解析度,並一次產生最多八張圖像。預覽顯示在像素藝術和漫畫生成表現出色。