📋較早收集於 30m

Google 測試 Omni 影片生成模型,即將於 I/O

Google 測試 Omni 影片生成模型,即將於 I/O
PostLinkedIn
📋閱讀原文: TestingCatalog

💡Google 洩漏 Omni 瞄準與 Sora 影片生成競爭,即將 I/O 亮相。(38字)

⚡ 30-Second TL;DR

有什麼變化

Google 測試 Omni 影片生成模型

為什麼重要

Omni 可能與 Sora 競爭影片 AI,提升 Google 多模態產品。AI 創作者將獲得動態內容生成新工具,改變影片合成競爭格局。

下一步行動

監控 Google I/O 2026,關注 Omni 模型展示與 API 預覽。

誰應關注:Researchers & Academics

關鍵要點

  • Google 測試 Omni 影片生成模型
  • 與 Gemini 連結為新影片工具
  • I/O 2026 前發現 UI 洩漏

🧠 深度解析

AI-generated analysis for this event.

🔑 增強重點摘要

  • Omni 模型採用了 Google 最新的原生多模態架構,旨在實現影片生成與音訊、文字輸入的即時同步處理,而非傳統的單向生成模式。
  • 根據洩漏的 UI 測試數據,Omni 整合了 Google 的 Project Astra 技術,允許使用者透過自然語言指令對生成的影片進行動態編輯與風格轉換。
  • 該模型在訓練階段使用了 Google 龐大的 YouTube 授權數據庫,強調在保持高解析度輸出的同時,顯著降低了生成延遲(Latency)。
📊 競品分析▸ Show
特色/模型Google OmniOpenAI SoraRunway Gen-3 Alpha
核心優勢原生多模態即時互動高度物理模擬與長影片生成專業級影片編輯與控制工具
定價模式預計整合於 Gemini Advanced訂閱制/API 計費訂閱制/點數制
基準測試側重多模態對齊與延遲側重物理一致性與時長側重藝術風格與精確控制

🛠️ 技術深入

  • 架構:基於 Transformer 的擴散模型(Diffusion Transformer, DiT)變體,優化了潛空間(Latent Space)的處理效率。
  • 多模態整合:採用了與 Gemini 1.5 Pro 相似的 Tokenizer,將影片幀、音訊波形與文字提示統一編碼。
  • 推理優化:利用 Google 自研的 TPU v5p 進行推論加速,支援 1080p 解析度下的即時預覽生成。

🔮 前景展望AI analysis grounded in cited sources

Google 將在 2026 年底前將 Omni 功能全面導入 YouTube Shorts 創作工具。
透過降低影片創作門檻,Google 旨在提升 Shorts 平台的內容產出量以對抗 TikTok。
Omni 的推出將迫使 AI 影片生成產業從單純的「文字轉影片」轉向「互動式影片生成」。
市場對即時編輯與多模態輸入的需求已成為衡量頂尖模型的新標準。

時間線

2023-12
Google 發布 Gemini 1.0,奠定原生多模態基礎。
2024-05
Google I/O 2024 展示 Project Astra,預告即時多模態互動願景。
2025-09
Google 內部開始針對 Omni 模型進行大規模壓力測試。
2026-04
Omni 模型測試版 UI 意外洩漏,引發業界對 I/O 發布的預期。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TestingCatalog