廉價 LLM 在 OCR 基準測試中表現出色
對 18 款 LLM 在 OCR 上進行基準測試,使用 42 份文件共 7,560 次呼叫,發現廉價及舊模型常以較低成本匹配高端準確度。發布開源數據集、框架、排行榜及免費測試工具。追蹤可靠性、每成功成本、延遲及關鍵欄位準確度。
Tag: #cost-optimization135 results
對 18 款 LLM 在 OCR 上進行基準測試,使用 42 份文件共 7,560 次呼叫,發現廉價及舊模型常以較低成本匹配高端準確度。發布開源數據集、框架、排行榜及免費測試工具。追蹤可靠性、每成功成本、延遲及關鍵欄位準確度。

螞蟻集團推出 Ling-2.6-Flash,一款 104B 參數 AI 模型,優化令牌效率與成本節省。該模型因大量令牌使用迅速流行。它推動更經濟的大型 AI 部署。

Anthropic 發表「Advisor Strategy」(顧問策略),以提升 Claude 使用時的成本效能。該策略會自主部署適合特定任務的不同性能 AI 模型。這能實現更有效率的自主工作流程執行。

清華大學、人大及面壁發布龍蝦,一款開源智能調度員,將成本降低58%。它優先保障資料隱私,確保敏感資料不出門。此工具針對高效AI工作負載管理。

使用 Amazon Bedrock AgentCore 建構對話式 FinOps 代理,管理多帳戶 AWS 成本。它整合 AWS Cost Explorer、Budgets 和 Compute Optimizer 的資料。團隊可即時查詢本月主要成本驅動因素。
將奈奎斯特-香農定理應用於 LLM 提示視為 6 頻帶訊號,減少幻覺等混疊。經優化約束實現 97% API 成本減 ($1,500 至 $45/月) 與 SNR 提升。開源,可 pip 安裝。

OpenAI 宣布最新 GPT-5.4 模型的輕量版「mini」與「nano」。這些版本維持高推論能力,同時優化回應速度與成本效率。可在免費方案、Go 方案中使用,並透過開發者 API 提供。

OpenClaw開源框架引發北京聚會示範:AI自我意識實驗、塔羅機器人、成本節省路由器、多代理行銷團隊取代半個部門。讓非程式員快速推出產品。

AT&T 重新設計 AI 協調層,以處理每日 80 億個 token,使用基於 LangChain 的多代理系統,其中大型代理指導專門的小型代理,由小型語言模型 (SLM) 驅動。這實現了高達 90% 的成本節省並改善延遲。他們最近在 Microsoft Azure 上推出 Ask AT&T Workflows,一個拖放式代理建構器,用於員工任務自動化,整合專有工具並有人類監督。

文章將具身智能形容為迎來「DeepSeek 時刻」,暗示中國機器人可能以更低成本超越 Figure AI。文章特別指出,該方案只使用兩隻標準夾爪,但摘要未提供具體基準數據或公司名稱。