Omnivoice:600+語言開源TTS推出
Omnivoice 是支援超過600種語言的零樣本多語言TTS模型,具備語音克隆與設計功能。它採用擴散語言模型架構,提供高品質語音與極快推論速度RTF 0.025。在HuggingFace上以Apache-2.0授權提供,但tokenizer有額外授權限制。
Tag: #voice-cloning35 results
Omnivoice 是支援超過600種語言的零樣本多語言TTS模型,具備語音克隆與設計功能。它採用擴散語言模型架構,提供高品質語音與極快推論速度RTF 0.025。在HuggingFace上以Apache-2.0授權提供,但tokenizer有額外授權限制。

KoboldCpp 以 1.110 版慶祝三週年,新增原生高品質 Qwen3 TTS(0.6/1.7B)支援語音克隆,以及 Ace Step 1.5 音樂生成。示範影片展示這些功能,包括一首史詩音樂作品。可於 GitHub 下載。

專業配音員正面臨工作被取代的危機,因為 AI 克隆了他們的聲音以進行低成本、高產量的內容生產。缺乏「聲音竊取」的法律框架,使得創作者在面對未經授權的使用時顯得無力。

ElevenLabs 發布了演員 Michael Caine 的官方授權 AI 語音複製品,用於錄製 Homer 的《奧德賽》有聲書。這標誌著高知名度名人語音授權在 AI 生成內容領域的重要應用。

漸凍症患者蔡磊在全身僅剩眼球能動的情況下,利用先進的 AI 語音克隆技術發表了名為《倒計時》的演講。此舉展示了輔助型 AI 在恢復重度身障人士溝通能力方面的巨大潛力。

ElevenLabs 與 Stan Lee Universe 合作,授權這位已故 Marvel 創作者的聲音與肖像權。這些內容將於 ElevenLabs Iconic Marketplace 及 Eleven Reader 應用程式中提供。

Spotify 正在整合 ElevenLabs 技術以簡化有聲書的創作流程。此舉顯示其擴大內容產品的廣泛策略,並預計於今年稍晚推出新的有聲書方案。
OpenAI 收購了 Weights.gg,這是一個先前專注於分享語音複製 AI 演算法的社交平台。此舉顯示 OpenAI 持續致力於擴展其音訊與生成式語音功能。

開源 Voxtral TTS 模型缺少編解碼器編碼器權重,阻礙了 ref_audio 的語音克隆功能。這些權重現已透過提供的連結取得。這完成了本地語音克隆功能的設定。

中國頂尖配音演員與工作室如邊江、729聲工場集體聲討未經授權的AI聲音克隆,用於視頻與App。多起訴訟提起,儘管TTS/VC技術濫用猖獗且有判例勝訴。維權難題包括克隆成本低與隱藏供應鏈。