
KokoClone 為 Kokoro TTS 增添語音克隆
KokoClone 為 Kokoro TTS 擴展零樣本語音克隆,使用 3-10 秒 WAV 片段,維持即時速度。支援多語言輸出,可在 CPU/CUDA 運行。全開源,提供 Gradio UI、CLI 和 HF 演示。
Tag: #voice-cloning35 results

KokoClone 為 Kokoro TTS 擴展零樣本語音克隆,使用 3-10 秒 WAV 片段,維持即時速度。支援多語言輸出,可在 CPU/CUDA 運行。全開源,提供 Gradio UI、CLI 和 HF 演示。
獨立開發者推出 Speaklone 應用程式,利用 MLX-Swift 在 macOS 上運行 1.7B 模型、在 iOS 上運行 0.6B Qwen3-TTS 模型進行裝置上推理,支持從 5-30 秒音頻樣本進行語音克隆及自然語言語音設計。支援無雲端依賴的串流 TTS,透過量化、快取限制及分塊解碼克服記憶體限制。目前已在 App Store 上架。

xAI 正在 Grok iOS 應用程式測試語音克隆功能。使用者可錄製自己的聲音,並在 Grok 內或透過連結分享使用。此功能提升語音互動的個人化體驗。

前 NPR 主持人 David Greene 起訴 Google,指 NotebookLM 的 AI 音頻概覽功能複製其獨特腔調。他認為這利用其聲音權威為陰謀論背書。Google 回應稱男聲由專業演員配音,與 Greene 無關。

天貓邀請 AI 生成的頂流人物段宴出演廣告,而配音演員在製作開始前便主動找上門。這起事件反映了中國 AI 短劇產業快速且缺乏規範的成長狀態。

據報犯罪分子利用 AI 生成的語音訊息冒充一名香港男子的父親,竊取 127 萬美元。安全專家建議,面對緊急金錢要求時,應使用私人暗號或其他獨立管道進行驗證。

Taylor Swift 申請「Hey, it's Taylor Swift」及「Hey, it's Taylor」商標,包含語音片段以對抗 AI 模仿。她在持續 AI 爭議中升級法律行動。科技法律複雜性使成功不確定。

AI 生成的表演讓 Val Kilmer 在新電影中重返銀幕。演員引用「不要害怕死者,也不要害怕我」,回應對 AI 的擔憂。這展示技術如何重塑演藝產業。

作者用語音 deepfake 測試父母,他們迅速察覺機器人語調,因連線不佳。主張製造 deepfakes 是有效對抗它們的關鍵。強調即時音頻處理限制。

環球音樂宣布,松任谷由實的AI生成語音「Yumi AraI」將在《MANGALOGUE:火之鳥》公演中擔任聲優。此公演改編自手塚治虫漫畫《火之鳥》。這是AI語音合成在漫畫改編現場表演中的新應用。