
OpenAI 開發可打斷語音模型
OpenAI 研發全新雙向語音模型,讓 ChatGPT 對話更自然流暢。核心突破為使用者打斷 AI 時,能即時調整回應,而非突然停止。
Tag: #voice-ai160 results

OpenAI 研發全新雙向語音模型,讓 ChatGPT 對話更自然流暢。核心突破為使用者打斷 AI 時,能即時調整回應,而非突然停止。

Anthropic 在 Claude Code 推出語音模式。此功能為 AI 程式設計輔助增添語音能力。它強化 Anthropic 在 AI 程式設計市場的地位。

維也納的 fonio.ai 表示,公司在不到一年內已突破 1,000 萬美元年度經常性收入。這個 AI 客戶通話平台於 2 月從預付模式轉向訂閱制後,達成了這項里程碑。

ChatGPT Voice 透過進階語音互動,帶來更自然流暢的對話體驗。近期測試顯示,它也逐步具備協助處理複雜桌面任務的能力。

LangChain 說明如何使用 LangSmith,從執行過程、結果與通話者體驗等面向評估 voice agents。這套流程結合 traces、程式碼評估器、LLM judges 與人工審查。

Microsoft 正在開發其首款原生即時語音模型,目前稱為 MAI Realtime。該模型已在 MAI Playground 環境中被發現。

Fish Audio 推出了專為即時對話 AI 設計的生產級語音模型 S2.1 Pro。該模型支援 83 種語言,並已開放 API 供開發者使用。

OpenAI 正在為其 Codex 模型測試全新的即時語音模式。此功能旨在協助使用者處理日常任務(如管理 Slack 更新與訂餐),將其應用範圍從單純的程式編碼擴展至日常事務。

早期中國大語言模型 MOSS 的開發團隊成立了模思智能,將重心轉向「情境智能」,優先發展端到端語音交互而非純文本模型。目前正開發語音轉寫、視頻理解及 TTS 等系列模型,旨在實現更自然的人機交互。

Rime 完成了 2,400 萬美元的 A 輪融資,旨在擴展其企業級語音 AI 平台。該公司目前每月處理超過 1 億通跨產業的客戶電話。