🤝較早收集於 20h

Together AI 即時語音代理推出

Together AI 即時語音代理推出
PostLinkedIn
🤝閱讀原文: Together AI Blog
#voice-agents#low-latency#stt-ttstogether-aitogether-aideepgramcartesia

💡Together AI 700ms 內語音代理:共置 STT/LLM/TTS + Deepgram/Cartesia。(68字)

⚡ 30-Second TL;DR

有什麼變化

共置 STT、LLM 和 TTS 基礎設施

為什麼重要

這降低開發者建置低延遲語音應用程式的門檻,有助加速客戶服務和助理應用的採用。它讓 Together AI 成為競爭性語音平台的定位。

下一步行動

在 Together AI 註冊並使用 Deepgram-Cartesia 整合原型化語音代理。

誰應關注:Developers & AI Engineers

關鍵要點

  • 共置 STT、LLM 和 TTS 基礎設施
  • 原生支援 Deepgram STT 和 Cartesia TTS
  • 端到端延遲低於 700ms

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 8 個來源。

🔑 增強重點摘要

  • Together AI 支援 MiniMax Speech 2.6 Turbo TTS 模型,提供低於 250ms 端到端延遲,並支援 40 多種語言。[1]
  • Together Audio API 由 Cartesia Sonic 提供動力,具備多語言支援及超現實語音品質,適用於多模態應用。[2]
  • 提供 serverless 開放原始碼 TTS 模型,支援即時串流 WebSocket API 及批次生成,無需專用實例。[3]
📊 競品分析▸ Show
平台端到端延遲主要特點基準
Together AI<700ms (Turbo <250ms)共置 STT/LLM/TTS, Deepgram/Cartesia/MiniMax 支援, serverless生產級語音代理 [1][2][3]
Retell AI~280ms企業級可靠性, CRM/電話整合低延遲對話 [4]
OpenAI Realtime低延遲語音到語音模型即時互動 [5]
Deepgram Aura優化即時ASR + TTS即時使用 [5]

🛠️ 技術深入

  • MiniMax Speech 2.6 Turbo:先進語音合成架構,優化音頻生成管線,支援 40+ 語言、多語言格式處理及自然發音。[1]
  • Together Audio API 整合 Cartesia Sonic:多聲音選擇、多語言,HIPAA/SOC2 合規,適用於代理工作流程如 NotebookLM 風格播客。[2]
  • 語音基礎設施支援即時/批次模式,包含 Whisper-large-v3 轉錄、Orpheus-3b TTS 串流,具中斷監控及非同步處理。[3]

🔮 前景展望AI analysis grounded in cited sources

Together AI 語音代理將主導企業多模態應用
其共置基礎設施及 serverless 模型降低延遲並簡化多模型協調,優於分散式 API 提供者。[2][3]
低延遲 TTS 將提升語音代理自然度
MiniMax Turbo 的 sub-250ms 延遲及 40+ 語言支援,使全球客戶服務更具競爭力。[1]
2026 年語音 AI 將成為 CX 核心
Together 等平台擴展至完整語音管線,與 Retell 等競爭推動產業標準化。[4][5]

時間線

2024-10
推出 Together Audio API 與 Cartesia Sonic 合作,提供低延遲 TTS。[2]
2025-01
擴展語音基礎設施,新增 serverless 開放原始碼 TTS 模型及即時推斷。[3]
2026-02
發布 MiniMax Speech 2.6 Turbo,優化生產級即時語音代理。[1]
2026-03
推出即時語音代理,整合共置 STT/LLM/TTS 基礎設施,低於 700ms 延遲。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Together AI Blog

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。