🎵
印度新創企業在語音 AI 領域挑戰 OpenAI
一家位於 Bangalore 的新創企業加入打造高度擬真人工語音的競爭。據報導,其 AI 模型在評分上可與 OpenAI 和 ElevenLabs 的系統相比。
Tag: #speech-synthesis8 results
一家位於 Bangalore 的新創企業加入打造高度擬真人工語音的競爭。據報導,其 AI 模型在評分上可與 OpenAI 和 ElevenLabs 的系統相比。

DeepMind 推出 Gemini 3.1 Flash TTS,為下一代具表現力的 AI 語音合成。該模型引入細粒度音頻標籤,提供對 AI 生成音頻的精確控制。這實現高度可自訂且自然的語音輸出。

微軟公布三款自家機器學習模型的公開預覽版,專注於語音辨識、語音合成及影像生成。此舉使微軟儘管與 OpenAI 合作,仍成為其競爭對手。

xAI 為 Grok 推出了 21 款全新的旗艦語音,旨在擴展其語音代理開發能力。這些新增功能提供了更佳的多語言支援,並專為生產環境的應用程式所設計。
科大訊飛公佈了一項關於人機交互系統中口音與風格控制的新專利。該技術實現了動態狀態繼承與場景感知語音合成。

聲碼器由貝爾實驗室的霍默·達德利在一世紀前開發,用以簡化電話線上的語音傳輸。它能有效捕捉並合成人類語音。在二戰中用於秘密通訊,後成為音樂現象。

BBC Technology 的 Tech Life 環節討論一款語音技能幾乎與人類無異的對話 AI。討論強調其先進的自然對話能力。