
LTX-2.5 讓開放式影片生成接近即時
LTX 發布開放權重的影片與世界模型 LTX-2.5,並原生整合至 ComfyUI。該公司表示,模型在 Nvidia 超級晶片上可於 6.8 秒內根據圖片生成 10 秒影片,同時新增多鏡頭生成、更好的解碼器、機器人支援與更快速的蒸餾推論。
Tag: #image-to-video7 results

LTX 發布開放權重的影片與世界模型 LTX-2.5,並原生整合至 ComfyUI。該公司表示,模型在 Nvidia 超級晶片上可於 6.8 秒內根據圖片生成 10 秒影片,同時新增多鏡頭生成、更好的解碼器、機器人支援與更快速的蒸餾推論。
精選清單排名開源模型於音頻生成(TTS、克隆、音樂)、圖像生成及圖像轉影片類別。亮點包括 Qwen3-TTS 用於 TTS、FLUX.1 用於圖像,以及 LTX-2.3 支援 4K 影片與音頻。提供 Hugging Face 連結快速存取。

Vercel 的 AI Gateway 現已整合 Kling 影片模型,包括最新的 Kling 3.0,可從文字、圖像或畫面產生電影級影片。主要功能包含多鏡頭敘事、同期音效,以及精準起始/結束畫面控制。Beta 版適用於 Pro、Enterprise 及付費用戶,透過 AI SDK 6 和 Gateway Playground 使用。

Vercel 的 AI Gateway 新增 Google Veo 模型,用於寫實影片生成並內建音效,支援文字與圖像輸入最高達 4K。功能包含快速模式迭代及圖像轉影片工作流程。Beta 版供 Pro、Enterprise 及付費用戶透過 AI SDK 6 使用。

Vercel 的 AI Gateway 現透過 AI SDK 6 支援 Beta 影片生成,適用於 Pro/Enterprise 使用者。它支援文字轉影片、圖像轉影片、圖像轉換及一致角色影片,使用 KlingAI 和 Google Veo 模型。開發者可無需授權費程式化生成電影級寫實影片。

Google 推出可供大眾使用的 AI 音樂生成工具,將音樂創作民主化。此舉讓非專家也能使用先進 AI 音頻功能。另外還有將產品照片轉換成吸引人影片的功能。

Honor 600 系列推出 AI Image to Video 2.0 功能。全設備上運行,將照片轉為影片,更快速且無常見 AI 瑕疵。隨即將推出手機一同亮相。