💰TechCrunch AI•最新收集於 14m
Ramp 推出 Router,支援多模型 AI 存取

💡了解 Ramp 的新 API 如何簡化多個 LLM 供應商之間的切換。
⚡ 30-Second TL;DR
有什麼變化
Ramp 推出名為 Router 的 AI 模型路由服務。
為什麼重要
Router 可能降低整合及切換不同語言模型所需的工程成本。對開發 AI 產品的企業而言,這或許能簡化多模型部署,並提升供應商彈性。
下一步行動
查看 Router 的 API 文件,並進行小規模評估,比較模型切換、延遲、可靠性及成本與現有整合方案的差異。
誰應關注:Developers & AI Engineers
關鍵要點
- •Ramp 推出名為 Router 的 AI 模型路由服務。
- •Router 讓使用者與企業能夠使用多種大型語言模型。
- •該服務透過 API 提供模型切換能力,支援 AI 應用程式整合。
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 21 個來源。
🔑 增強重點摘要
- •Ramp的Router服務於2026年8月19日以Router.com的名稱正式推出,旨在成為所有主要AI模型的單一API端點。
- •該服務最初由Ramp內部開發並使用了三年,成功將其自身的AI推理成本降低了約30%,同時保持了99.9%以上的生產流量可靠性。
- •Router.com在2026年內提供免費路由服務,用戶只需支付所消耗的token列表價格,新用戶還可獲得26美元的點數。
- •Router支援來自OpenAI、Anthropic、SpaceXAI (Grok) 等供應商的27種模型,以及Nvidia、Kimi、DeepSeek、GLM和Qwen等開源模型,並預計很快將支援Gemini。
- •Router服務的早期客戶平均將推理成本降低了40%,部分客戶甚至實現了高達92%的成本節省。
- •Router透過將模型選擇決策與Ramp更廣泛的AI支出可視化和控制功能相結合,為企業提供了更清晰的AI工作成本視圖及優化機會。
📊 競品分析▸ Show
| 服務/平台 | 主要功能 | 定價模式 | 性能/基準 |
|---|---|---|---|
| Ramp Router | 智能路由至最低成本且符合品質標準的模型;單一API端點;自動故障轉移;100多種優化;AI支出可視化與控制;支援多種路由策略(Flex tier, Shadow models, Benchmark routing, NVIDIA Switchyard)。 | 2026年前路由免費,用戶支付token列表價格;新用戶獲26美元點數。 | 早期客戶平均節省40%推理成本;Ramp內部節省30%;每月處理超過2.75兆token。 |
| Bifrost by Maxim AI | 企業級編排;自動故障轉移;模型上下文協議整合;原生可觀察性;智能負載平衡;語義快取;單一OpenAI兼容API。 | 未明確說明,但強調企業級解決方案。 | Go語言構建,超低延遲(每請求僅增加11微秒開銷,5,000 RPS)。 |
| LangChain | 開源框架;可組合組件;Python/TypeScript SDK;鏈式組合;代理框架;記憶體管理。 | 開源,免費使用。 | 框架靈活性高,適用於複雜AI工作流程。 |
| Portkey | AI閘道及治理;路由、回退、預算、護欄;多供應商單一介面;快取、可觀察性、使用控制。 | 免費層級每月1萬條日誌,之後按日誌量計費。 | 提供路由、重試、快取、可觀察性等功能。 |
| LiteLLM | 開源AI閘道;單一OpenAI兼容代理,支援所有供應商;預算控制;多供應商支援。 | 開源,免費使用;可自行託管。 | 流行開源選項,但在大規模應用時性能可能成為問題。 |
| OpenRouter | 模型市場聚合器;單一API支援400多個模型;自動路由功能(根據成本和品質選擇最佳模型)。 | 信用卡購買收取5.5%費用,小額交易最低0.80美元。 | 廣泛的模型覆蓋範圍。 |
| Cloudflare AI Gateway | 邊緣優先路由;與Cloudflare生態系統整合;快取、速率限制、日誌、分析、請求重試;多供應商故障轉移;邊緣流緩衝。 | 未明確說明。 | 請求在最近的Cloudflare PoP處理,邊緣開銷低於10毫秒。 |
🛠️ 技術深入
- Ramp Router提供一個與OpenAI和Anthropic兼容的單一API端點,簡化了多模型存取。
- 服務的核心功能是將每個AI請求路由到滿足開發者品質標準的最低成本模型。
- 內建自動故障轉移機制,當某個供應商出現故障時,請求會自動切換到備用供應商。
- 包含超過100種優化措施,涵蓋模型選擇、快取、壓縮、時間和請求處理等方面。
- 採用「Ramp SWE-Bench」作為基準測試,該基準基於Ramp實際的生產工程任務,持續測試新模型並自動將表現最佳的模型納入預設路由策略。
- 支援多種路由策略,包括:
- Flex tier:監控折扣服務層級的延遲,當其與標準層級相當時,將請求導向成本較低的選項。
- Shadow models:將一小部分實際請求發送給候選模型進行測試,同時現有模型繼續服務用戶,以便在不影響生產的情況下比較成本和延遲。
- Benchmark routing:允許用戶根據自定義權重對可用模型進行基準測試排名,並將請求發送給得分最高的模型。
- NVIDIA Switchyard:專為代理工作流程設計,僅在工作需要時才使用昂貴的模型。
- Router會儲存模型輸入、輸出和元數據,用於改進服務,但用戶可以在設定中關閉此功能,並選擇支援零數據保留的美國託管模型。
- 對於現有的OpenAI或Anthropic SDK用戶,切換到Ramp Router只需更改一行基礎URL。
🔮 前景展望AI analysis grounded in cited sources
AI模型路由服務將成為企業AI基礎設施的標準組件。
隨著大型語言模型市場的碎片化和企業對成本優化的需求日益增加,此類服務將成為有效管理和利用多個模型的關鍵工具。
成本優化將成為AI應用開發的關鍵驅動力。
Ramp Router等服務證明了透過智能路由可以顯著降低推理成本,這將促使更多企業採用類似策略以提高AI投資回報率。
AI模型供應商將面臨更大的價格競爭壓力。
路由服務使客戶能夠輕鬆切換模型以尋求最佳性價比,這將迫使模型供應商在定價和性能上更具競爭力。
⏳ 時間線
2019-03
Ramp公司成立
2020-02
Ramp正式推出企業卡和費用管理平台
2023-08
Ramp開始內部開發AI模型路由工具
2025-06
Ramp AI Index顯示企業AI支出自此時起增長了20.7倍
2026-07
Ramp Router開放早期測試
2026-08-19
Ramp正式推出AI模型路由服務Router.com
📎 來源 (21)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechCrunch AI ↗
每週 AI 簡報
每週一封,可隨時退訂。
