
PPIO 發布 Fusion,價格僅頂級模型十分之一
PPIO 正式發布 Fusion 模型,宣稱其智慧能力可超越頂級模型,而價格僅為其十分之一。這項發布將 Fusion 定位為生產環境 AI 工作負載中更具成本效益的選擇。
Tag: #inference-cost49 results

PPIO 正式發布 Fusion 模型,宣稱其智慧能力可超越頂級模型,而價格僅為其十分之一。這項發布將 Fusion 定位為生產環境 AI 工作負載中更具成本效益的選擇。

Sand.ai 開源了一款擁有 114B 參數、6B 啟用參數的 Mixture-of-Experts 影片生成模型。據稱,該模型可生成 10 秒 1080p 影片,成本約為人民幣 0.5 元。

DeepSeek 開放 V4 Flash API 公測,憑藉顯著的價格優勢與更高的 Agent 基準測試表現,加劇市場所稱的「DeepSeek 斬殺線」。文章認為,模型公司面臨長期回報不確定性,因為成本快速下降、切換成本低與高額資本需求,可能讓效率紅利流向開發者與應用公司。

針對七家主要 LLM 推論供應商的定價比較分析顯示,快取策略對總成本有顯著影響。作者強調,對於 AI Agent 和 RAG 管道而言,快取命中率通常比標題上的 Token 單價更為關鍵。

有報導指出 OpenAI 正考慮大幅調降 Token 價格以維持競爭優勢。此舉可能顯著降低開發者在 OpenAI 平台上構建應用的成本門檻。

據悉 OpenAI 正考慮大幅調降其服務價格。與此同時,科技產業正面臨供應鏈壓力,SK Hynix 的多家設備供應商已提出漲價要求。

來自 Meta、Google 及多所大學的研究人員推出了 AutoTTS 框架,能自動發掘最佳的測試時縮放(TTS)策略。此方法消除了手動調整啟發式規則的需求,讓模型在維持準確度的同時,能有效管理推理預算。

Google 在 I/O 大會上發布了 Gemini Omni 與 3.5 Flash 模型,標誌著智能代理時代的開啟。然而,新版 Flash 模型的成本較前代大幅上漲了 5 倍。

Together AI 與 Pearl Research Labs 合作推出 Gemma-4-31B-it-pearl 模型的折扣推論端點。此計畫利用「有用工作證明」(Proof of Useful Work) 將 AI 工作負載轉化為加密貨幣排放,進而降低營運成本。
中國模型佔OpenRouter前十六席,小米MiMo-V2-Pro以4.82萬億Token領先;自2026年2月起超越美國模型。價格差距10-60倍推動高Token代理應用如OpenClaw採用。SWE-Bench基準性能逼近美國對手。