
Token 價格讓位於任務經濟學
DeepSeek 等中國模型供應商正在提高 API 價格,而 OpenAI 與 Anthropic 則降價或取消原定漲價計畫。這反映 AI 定價正從以 Token 為核心,轉向考量單項任務成本、算力供給、任務價值與使用者規模。
Tag: #inference-cost49 results

DeepSeek 等中國模型供應商正在提高 API 價格,而 OpenAI 與 Anthropic 則降價或取消原定漲價計畫。這反映 AI 定價正從以 Token 為核心,轉向考量單項任務成本、算力供給、任務價值與使用者規模。

LangChain 在 145 個 agent 任務上測試 NVIDIA NeMo Switchyard,發現只有 7% 的互動回合需要 frontier model。智慧路由可降低 74% 成本,但需承擔六個百分點的準確率取捨。

SmarCo HT Tech 正在開發一款 RISC-V 資料流晶片,目標是降低 AI 影片生成的成本。這項工作瞄準快速成長的市場,該市場正受到 ByteDance 的 Seedance 2.0、Seedance 2.5 及 MiniMax H3 推動。

Together AI 在 900 次 DeepSWE 執行中比較 DeepSeek-V4 Flash 0731 與 GPT-5.6 Luna。GPT-5.6 Luna 的 pass@1 領先 14 個百分點,而 DeepSeek 每美元可完成的解題數量高出 4.8 倍。

MiniMax H3 在發布後不久便已可直接使用,價格更降至幾分錢級別。這項更新凸顯 MiniMax 積極降低最新模型使用門檻的策略。

AI 大模型產業已進入競爭日益殘酷的階段,效能門檻持續上升,市場空間不斷收窄。隨著 Agent 成為主流應用形式,供應商的競爭焦點已從單輪對話基準轉向端到端任務的整體性價比。

據稱一個月內推出了 9 款旗艦級大型語言模型,凸顯模型發布週期正在加速。文章認為,「最強模型」的實用保質期正變得越來越短。
中國領先科技企業正將商業模式從出租原始 GPU 硬體轉向「Token 即服務」(TaaS)。此轉變反映了產業趨勢,即按產出的 Token 數量計費,而非僅按基礎設施容量計費。

本文討論了AI商業模式從單純關注智能轉向基於 Token 計費的殘酷現實。強調了像 xAI 這樣的主要參與者如何掌握推理成本的變現能力。

據報導,AMD Radeon RX 9050 在 1080P 解析度下的性能約落後 RTX 5050 20%。這款 GPU 於 7 月底在拉丁美洲、亞太地區及日本推出,但 AMD 據稱未提供評測樣品,因此全球評測數量相當有限。