OpenClaw Beta.3:TTS 大升級與外掛註冊
OpenClaw 2026.4.25-beta.3 推出完整 TTS 升級,含 /tts latest、自動控制、人格及 Azure Speech、Xiaomi、Inworld 等提供者。外掛採用冷持久註冊表,簡化更新與發現。OpenTelemetry、瀏覽器自動化、UI 及安裝改進完善本版。
Tag: #tts36 results
OpenClaw 2026.4.25-beta.3 推出完整 TTS 升級,含 /tts latest、自動控制、人格及 Azure Speech、Xiaomi、Inworld 等提供者。外掛採用冷持久註冊表,簡化更新與發現。OpenTelemetry、瀏覽器自動化、UI 及安裝改進完善本版。

用戶在本地即時運行 Qwen3 TTS,用於富有表現力的 VTuber 管線。實作串流、llama.cpp 支援、CTC 對齊,並微調自訂聲音。分享 Persona Engine GitHub 儲存庫。
OpenClaw 2026.4.15-beta.2 預覽 Anthropic 模型預設更新至 Claude Opus 4.7 及 Google 插件中的 Gemini TTS 整合。包含閘道工具安全性初始修復,防止與內建工具名稱衝突。

開發者優化 Kokoro TTS 用於 iOS,採用純 CPU 管線,透過拆分模型並使用 Apple Accelerate 框架,達到 20 倍即時速度且無過熱問題。避開 Metal 以支援背景音頻。發布為 Morph Books EPUB 閱讀器應用。
教育部、國家語委發布兩項AI領域語言文字規範:《機器合成普通話水平測評等級標準及測評大綱》和《人工智能語料庫基礎術語》。積極回應AI時代語言需求。由语文出版社正式出版。

Mistral AI 在 Hugging Face 推出 Voxtral-4B-TTS-2603。此全新 4B 參數文字轉語音模型擴展 Mistral 多模態產品。經 Reddit r/LocalLLaMA 分享。

MiMo-V2-Pro、Omni 和 TTS 模型開發者承諾穩定後開放原始碼。來自 _LuoFuli 的 X 貼文公告。於 r/LocalLLaMA 分享。

Hume AI 發布其首個開源文字轉語音 (TTS) 模型 TADA。TADA 採用文字-聲學雙重對齊標記化,可產生五倍速即時語音。它支援高達 700 秒的音頻輸出。

KokoClone 為 Kokoro TTS 擴展零樣本語音克隆,使用 3-10 秒 WAV 片段,維持即時速度。支援多語言輸出,可在 CPU/CUDA 運行。全開源,提供 Gradio UI、CLI 和 HF 演示。

Google 正在為 Gemini 開發新的語音自訂功能,允許使用者調整語氣的能量、溫暖度、正式程度與語速。此更新旨在提供更個人化且自然的互動體驗。