💰最新收集於 14m

Ramp 推出 Router,支援多模型 AI 存取

Ramp 推出 Router,支援多模型 AI 存取
PostLinkedIn
💰閱讀原文: TechCrunch AI

💡了解 Ramp 的新 API 如何簡化多個 LLM 供應商之間的切換。

⚡ 30-Second TL;DR

有什麼變化

Ramp 推出名為 Router 的 AI 模型路由服務。

為什麼重要

Router 可能降低整合及切換不同語言模型所需的工程成本。對開發 AI 產品的企業而言,這或許能簡化多模型部署,並提升供應商彈性。

下一步行動

查看 Router 的 API 文件,並進行小規模評估,比較模型切換、延遲、可靠性及成本與現有整合方案的差異。

誰應關注:Developers & AI Engineers

關鍵要點

  • Ramp 推出名為 Router 的 AI 模型路由服務。
  • Router 讓使用者與企業能夠使用多種大型語言模型。
  • 該服務透過 API 提供模型切換能力,支援 AI 應用程式整合。

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 21 個來源。

🔑 增強重點摘要

  • Ramp的Router服務於2026年8月19日以Router.com的名稱正式推出,旨在成為所有主要AI模型的單一API端點。
  • 該服務最初由Ramp內部開發並使用了三年,成功將其自身的AI推理成本降低了約30%,同時保持了99.9%以上的生產流量可靠性。
  • Router.com在2026年內提供免費路由服務,用戶只需支付所消耗的token列表價格,新用戶還可獲得26美元的點數。
  • Router支援來自OpenAI、Anthropic、SpaceXAI (Grok) 等供應商的27種模型,以及Nvidia、Kimi、DeepSeek、GLM和Qwen等開源模型,並預計很快將支援Gemini。
  • Router服務的早期客戶平均將推理成本降低了40%,部分客戶甚至實現了高達92%的成本節省。
  • Router透過將模型選擇決策與Ramp更廣泛的AI支出可視化和控制功能相結合,為企業提供了更清晰的AI工作成本視圖及優化機會。
📊 競品分析▸ Show
服務/平台主要功能定價模式性能/基準
Ramp Router智能路由至最低成本且符合品質標準的模型;單一API端點;自動故障轉移;100多種優化;AI支出可視化與控制;支援多種路由策略(Flex tier, Shadow models, Benchmark routing, NVIDIA Switchyard)。2026年前路由免費,用戶支付token列表價格;新用戶獲26美元點數。早期客戶平均節省40%推理成本;Ramp內部節省30%;每月處理超過2.75兆token。
Bifrost by Maxim AI企業級編排;自動故障轉移;模型上下文協議整合;原生可觀察性;智能負載平衡;語義快取;單一OpenAI兼容API。未明確說明,但強調企業級解決方案。Go語言構建,超低延遲(每請求僅增加11微秒開銷,5,000 RPS)。
LangChain開源框架;可組合組件;Python/TypeScript SDK;鏈式組合;代理框架;記憶體管理。開源,免費使用。框架靈活性高,適用於複雜AI工作流程。
PortkeyAI閘道及治理;路由、回退、預算、護欄;多供應商單一介面;快取、可觀察性、使用控制。免費層級每月1萬條日誌,之後按日誌量計費。提供路由、重試、快取、可觀察性等功能。
LiteLLM開源AI閘道;單一OpenAI兼容代理,支援所有供應商;預算控制;多供應商支援。開源,免費使用;可自行託管。流行開源選項,但在大規模應用時性能可能成為問題。
OpenRouter模型市場聚合器;單一API支援400多個模型;自動路由功能(根據成本和品質選擇最佳模型)。信用卡購買收取5.5%費用,小額交易最低0.80美元。廣泛的模型覆蓋範圍。
Cloudflare AI Gateway邊緣優先路由;與Cloudflare生態系統整合;快取、速率限制、日誌、分析、請求重試;多供應商故障轉移;邊緣流緩衝。未明確說明。請求在最近的Cloudflare PoP處理,邊緣開銷低於10毫秒。

🛠️ 技術深入

  • Ramp Router提供一個與OpenAI和Anthropic兼容的單一API端點,簡化了多模型存取。
  • 服務的核心功能是將每個AI請求路由到滿足開發者品質標準的最低成本模型。
  • 內建自動故障轉移機制,當某個供應商出現故障時,請求會自動切換到備用供應商。
  • 包含超過100種優化措施,涵蓋模型選擇、快取、壓縮、時間和請求處理等方面。
  • 採用「Ramp SWE-Bench」作為基準測試,該基準基於Ramp實際的生產工程任務,持續測試新模型並自動將表現最佳的模型納入預設路由策略。
  • 支援多種路由策略,包括:
    • Flex tier:監控折扣服務層級的延遲,當其與標準層級相當時,將請求導向成本較低的選項。
    • Shadow models:將一小部分實際請求發送給候選模型進行測試,同時現有模型繼續服務用戶,以便在不影響生產的情況下比較成本和延遲。
    • Benchmark routing:允許用戶根據自定義權重對可用模型進行基準測試排名,並將請求發送給得分最高的模型。
    • NVIDIA Switchyard:專為代理工作流程設計,僅在工作需要時才使用昂貴的模型。
  • Router會儲存模型輸入、輸出和元數據,用於改進服務,但用戶可以在設定中關閉此功能,並選擇支援零數據保留的美國託管模型。
  • 對於現有的OpenAI或Anthropic SDK用戶,切換到Ramp Router只需更改一行基礎URL。

🔮 前景展望AI analysis grounded in cited sources

AI模型路由服務將成為企業AI基礎設施的標準組件。
隨著大型語言模型市場的碎片化和企業對成本優化的需求日益增加,此類服務將成為有效管理和利用多個模型的關鍵工具。
成本優化將成為AI應用開發的關鍵驅動力。
Ramp Router等服務證明了透過智能路由可以顯著降低推理成本,這將促使更多企業採用類似策略以提高AI投資回報率。
AI模型供應商將面臨更大的價格競爭壓力。
路由服務使客戶能夠輕鬆切換模型以尋求最佳性價比,這將迫使模型供應商在定價和性能上更具競爭力。

時間線

2019-03
Ramp公司成立
2020-02
Ramp正式推出企業卡和費用管理平台
2023-08
Ramp開始內部開發AI模型路由工具
2025-06
Ramp AI Index顯示企業AI支出自此時起增長了20.7倍
2026-07
Ramp Router開放早期測試
2026-08-19
Ramp正式推出AI模型路由服務Router.com
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechCrunch AI

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。

Ramp Launches Router for Multi-Model AI Access | TechCrunch AI | SetupAI | SetupAI