來源最新收集於 12m

Mercury 2.5 帶來超高速擴散式推理

Mercury 2.5 帶來超高速擴散式推理
PostLinkedIn
📋閱讀原文: TestingCatalog
#diffusion-llm#inference-speed#context-window#launch-pricingmercury-2.5inceptionmercury-2-5

💡了解 Mercury 2.5 每秒 1,107 個 token 的速度,是否能改變即時 LLM 應用的成本效益。

⚡ 30 秒速覽

有什麼變化

Mercury 2.5 宣稱可達每秒 1,107 個 token 的生成速度。

為什麼重要

高吞吐量與長 context window 的組合,可能讓 Mercury 2.5 適合對延遲敏感的應用與大型文件工作流程。開發者仍需獨立測試,以驗證其品質、可靠性,以及擴散式推理在實際使用中的經濟效益。

下一步行動

在對延遲敏感及需要長 context 的工作負載上測試 Mercury 2.5,並與目前使用的 LLM 比較輸出品質與成本。

誰應關注:Developers & AI Engineers

關鍵要點

  • Mercury 2.5 宣稱可達每秒 1,107 個 token 的生成速度。
  • 模型支援 260K context window。
  • Inception 以低廉定價推出此模型。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TestingCatalog

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。