
OpenAI 下調 GPT-5.6 Sol 開發者定價逾 20%
OpenAI 宣布,未來三個月內,其前沿模型 GPT-5.6 Sol 的開發者定價將下調超過 20%。此舉正值 Anthropic 及多個中國 AI 模型帶來激烈競爭之際。
Tag: #inference-cost49 results

OpenAI 宣布,未來三個月內,其前沿模型 GPT-5.6 Sol 的開發者定價將下調超過 20%。此舉正值 Anthropic 及多個中國 AI 模型帶來激烈競爭之際。
中國主要網路公司正大幅增加在 AI 基礎設施、晶片、基礎模型與應用上的投入。Alibaba、Tencent、Baidu 與 ByteDance 都押注 AI 能取代逐漸失效的流量護城河,但不斷上升的推理成本與惡化的現金流也帶來重大財務壓力。

Together AI 在 904 次 DeepSWE rollout 中比較 GLM-5.3 與 GPT-5.6 Sol。GPT-5.6 Sol 的 pass@1 領先 3.7 個百分點,但 GLM-5.3 以約一半成本取得更高的 pass@4;GLM 優先的級聯策略達到 85.9%。

文章指出,中國 AI 產業正從單純堆疊加速卡,轉向衡量每個 Token 所創造的經濟價值。文章將 2026 年視為降低 Token 生產成本與提升算力效率的關鍵時期。

模型價格下降反而推高了AI整體支出。Gartner預測,到2028年,每個工作流程的AI推論成本可能上升五倍以上,因此ROI管理將變得更加重要。

Together AI 在 904 次 DeepSWE 執行中比較了 DeepSeek V4 Pro 0813 與 GPT-5.6 Sol。Sol 的 pass@1 領先 10 個百分點,但成本是 35 倍;Pro 則在 pass@4 表現較佳,且以 Pro 優先的級聯策略達到 83.0%。

AOE Tech Labs 表示,其 Floatboat Harness 讓 DeepSeek-V4-Flash 在五項測試基準中全部擊敗 Claude Opus 4.8。這項單一變因實驗只更換執行 Harness,並使用相同的 0.14 美元模型,成本低至 57.1 分之一。

文章介紹 Moonshot AI 的 Kimi K3,稱其為擁有 2.8 兆參數、在程式設計、知識、推理與視覺任務上達到前沿水準的開源模型。文章認為,Kimi K3 的發布在美國引發重大爭論,原因是低成本開放權重模型可能削弱閉源模型供應商的定價能力與監管優勢。
AI 蒸餾技術允許較小且成本較低的模型模擬大型昂貴系統的效能。此趨勢威脅到那些投入數十億美元開發大型 AI 公司的商業模式,因為競爭對手現在能以極低的成本達到相似的成果。

NVIDIA Rubin GPU 具 3360 億電晶體、288 GB HBM4 記憶體及 22 TB/s 頻寬。宣稱 AI 工作負載下推論成本效率提升 10 倍。