
Sapiom 募得 3,500 萬美元,降低 AI 代理成本
位於 AI 代理與其使用模型之間的舊金山新創公司 Sapiom,完成由 Dragonfly 領投的 3,500 萬美元 A 輪融資。本輪讓公司累計募資達 5,000 萬美元,Anthropic 也參與支持。
Tag: #inference-costs50 results

位於 AI 代理與其使用模型之間的舊金山新創公司 Sapiom,完成由 Dragonfly 領投的 3,500 萬美元 A 輪融資。本輪讓公司累計募資達 5,000 萬美元,Anthropic 也參與支持。

據報導,Anthropic 正在組建自研晶片團隊,為旗下 Claude 模型開發專用人工智慧晶片。公司發言人已公開證實這項策略規劃,這是 Anthropic 首次確認自研晶片計畫。

GitHub 將為 Copilot 使用者引入依實際 AI 消耗量計費的定價模式。此變動針對最重度使用者的推理成本不斷上升,GitHub 表示無法再完全吸收這些成本。
DeepSeek 自4月26日起將全系列 API 服務輸入快取命中價格降至原價十分之一。Pro 模型至2026年5月5日前疊加2.5折優惠。V4-Pro 降至0.025元/百萬 Tokens,V4-Flash 為0.02元/百萬 Tokens。

AI token成為工程師薪酬核心,與現金股權並列。Nvidia黃仁勳倡議配薪水一半价值的token,提升10倍生產力。重度用戶年成本達10萬美元,促使招聘談判token。

whatllm.org 2026 年 1 月報告基準測試 94 個 LLM 端點,顯示開源模型品質指數僅落後專有領導者 5 分。頂尖開源如 GLM-4.7(68 QI)和 DeepSeek V3.2 匹敵 Gemini 3 Pro(73 QI)和 GPT-5.2。開源大幅降低成本,如 $0.30/M 對比 $3.50/M,差距從年初的 12 分縮減。

Nvidia Q4 營收達 681 億美元(年增 73%)但股價跌,因 AI 供應鏈疑慮;Rubin 平台承諾推理成本降 10 倍。Blackwell Ultra 在 Agentic AI 較 Hopper 提升 50 倍,已獲微軟谷歌大單。轉向 Agent 經濟學應對 DeepSeek 等效率挑戰。

DeepSeek 推出 Claude Code 的競品,同時大幅提高 V4 系列模型的價格。自 8 月 16 日起,V4-Pro 與 V4-Flash 的尖峰輸出 token 價格,分別從每百萬 0.87 美元與 0.28 美元上調至 3.96 美元與 1.32 美元。

Google 的 Gemini 3.7 Flash 現已透過 Vercel AI Gateway 提供,優惠價持續至 2026 年 12 月 31 日。該模型針對軟體工程、代理式工作流程與設計轉程式碼生成進行優化,並提升任務執行可靠性。
MiniMax H3 與 ByteDance 的 Seedance 2.5 接連推出,憑藉出色的 AI 影片效果引發關注。然而,約每生成一秒需人民幣 2 元的成本,引發市場對高品質 AI 影片仍然過於昂貴、一般使用者難以負擔的疑慮。