
天下沒有免費的 DeepSeek
文章以「天下沒有免費的 DeepSeek」為題,質疑使用 DeepSeek 不需付出實質成本的想法。現有節錄未提供具體定價、基礎設施或商業模式細節。
Tag: #inference-cost49 results

文章以「天下沒有免費的 DeepSeek」為題,質疑使用 DeepSeek 不需付出實質成本的想法。現有節錄未提供具體定價、基礎設施或商業模式細節。

一項預先註冊的研究比較了 Sonnet 5 明確使用高推理努力與省略該參數時的表現。高推理努力請求平均每次多花費 0.01031 美元,但在 30 道 AIME 2026 題目上未偵測到準確率提升。
DeepSeek、Qwen 和 Moonshot 正逐漸成為領先美國 AI 平台更便宜且更具適應性的替代方案。Bloomberg 引述的研究顯示,這些模型的能力已接近美國主要模型,令美國 AI 公司面臨競爭壓力。

文章主張,受監管的 RAG 分類系統不應將所有模糊案例直接交給 LLM。級聯架構會先處理可由規則決定的案例,再擷取針對性證據,最後只將未解決的案例升級給模型,以提升可稽核性、一致性、成本效益與延遲表現。

Gemini 3.7 Flash 被描述為一次突襲式發布,主打接近旗艦模型的效能與大幅降低的價格。文章也指出,DeepMind 新任主管正重新塑造市場的成本效能競爭門檻。

DeepSeek 大幅調漲 V4 API 價格,部分快取輸入價格最高上漲 1,100%。隨著 V4-Pro 正式發布並升級 VR-Flash,DeepSeek 也導入尖峰與離峰定價。

IBM 透過與 Together AI 的多年合作協議投入 2.4 億美元,將 Nvidia Blackwell 系統導入 IBM Cloud。這項策略聚焦於降低推理成本,並利用開源技術與超大規模雲端業者競爭。

Nvidia 推出 300 億參數的開放式混合專家模型 Nemotron 3.5 Lightning,以及開源的 NeMo Switchyard 路由函式庫。Nvidia 表示,兩者搭配可維持接近前沿模型的任務完成率,同時將基準測試成本降至單獨運行 Opus 4.8 的約三分之一。

MiniMax 在 Seedance 2.5 發布後不久推出 H3,主打較低生成成本、原生音訊、影片編輯與開放權重,而非全面領先的模型能力。文章認為,H3 的長期優勢取決於生態採用率與模型品質,因為 Wan 3.0 等競爭者可能迅速縮小價格差距。

文章指出,OpenAI 將免費 ChatGPT 使用者升級至 GPT-5.6 Luna,取消純文字對話次數限制,並新增可進行更深度推理的 Think 按鈕。同時,DeepSeek 因使用量暴增與容量壓力,計畫大幅提高 API 價格,凸顯 AI 產業正從價格戰轉向以成本為核心的商業化。