Search

Tag: #fast-inference6 results

Opus 4.7 快速模式現於 AI Gateway

Opus 4.7 快速模式現於 AI Gateway

Claude Opus 4.7 的快速模式現已在 Vercel AI Gateway 的研究預覽中可用,提供約 2.5 倍更快的輸出 token 生成,保留完整模型智能。此實驗功能定價為標準 Opus 費率的 6 倍,輸入 $30/百萬 token,輸出 $150/百萬 token。可透過 provider options 或 Claude Code 環境變數啟用。

OpenAI Launches Speedy Codex-Spark Model

OpenAI Launches Speedy Codex-Spark Model

OpenAI released GPT-5.3-Codex-Spark, a lightweight version of its Codex intelligent agent programming tool. This slimmed-down model prioritizes extreme inference speed for rapid iteration scenarios. It follows the latest full Codex model released earlier this month.

cnBeta (Full RSS)MediaFeb 13#launch#openai#gpt-53-codex-spark