🗾最新收集於 74m

Gemini Omni 1.1 Flash 將影片延長至 40 秒

Gemini Omni 1.1 Flash 將影片延長至 40 秒
PostLinkedIn
🗾閱讀原文: ITmedia AI+ (日本)
#video-gen#multimodal-ai#4k-upscalinggemini-omni-1.1-flashgooglegemini omni 1.1 flash

💡透過上下文延長與影格級控制,打造更長且更連貫的 AI 影片。

⚡ 30-Second TL;DR

有什麼變化

可參考最多 10 秒的前置內容來延續場景

為什麼重要

這項更新可改善 AI 生成影片工作流程中的連貫性,特別適合短篇敘事與反覆編輯。開發者可能不必拼接大量獨立片段,就能打造控制能力更強的影片應用程式。

下一步行動

使用 Gemini Omni 1.1 Flash API 製作場景延續原型,測試 10 秒上下文延長及起始/結束影格控制功能。

誰應關注:Developers & AI Engineers

關鍵要點

  • 可參考最多 10 秒的前置內容來延續場景
  • 可將生成場景延長至最長 40 秒
  • 支援由起始影格與結束影格控制影片生成
  • 透過 API 與工具提供從快速 360p 預覽到 4K 放大的能力

🧠 深度解析

背景與延伸:來自公開資料,非原文內容。引用 10 個來源。

🔑 增強重點摘要

  • Gemini Omni 1.1 Flash 引入了全新的價格階梯制度,根據解析度從 360p 的每秒 0.03 美元到 4K 的每秒 0.30 美元進行計費。
  • 開發者現在可以提供長達 3 秒的現有影片作為參考素材,以維持生成場景中的角色一致性與視覺風格。
  • 新增的 360p 草稿模式在生成速度上提升了 60%,且成本僅為 720p 標準輸出的三分之一,大幅優化了迭代效率。
  • 該模型不僅限於單一平台,已全面整合至 Gemini API、Google AI Studio、Gemini Enterprise Agent Platform 及 Google Cloud。
  • 相較於前代僅 1 秒的上下文限制,Omni 1.1 Flash 的上下文窗口顯著擴展,能更精準地分析前 10 秒的影像以確保敘事連貫性。
📊 競品分析▸ Show
功能/模型Gemini Omni 1.1 FlashOpenAI SoraRunway Gen-3 Alpha
最大生成長度40 秒60 秒10 秒 (單次)
關鍵影格控制支援 (首尾影格)支援支援
價格結構每秒 $0.03 - $0.30未公開訂閱制/點數制
預覽模式支援 (360p 高速版)

🛠️ 技術深入

  • 採用多模態架構,針對影片生成任務優化了時序一致性演算法。
  • 支援基於首尾影格的插值生成技術,能自動計算並補全中間的運動軌跡(如變焦與軌道移動)。
  • 整合了 4K 超解析度放大模型,允許從低解析度草稿直接進行高畫質渲染。
  • 具備影片參考編碼器,可提取輸入影片的特徵向量以維持跨場景的視覺風格一致性。

🔮 前景展望AI analysis grounded in cited sources

影片製作成本將大幅降低
360p 草稿模式與明確的價格階梯使開發者能以極低成本進行大規模的創意原型驗證。
專業影視工作流將整合生成式 AI
支援 4K 輸出與首尾影格控制功能,滿足了專業製作對於畫質與精確構圖的嚴格要求。

時間線

2026-08
Google 正式發布 Gemini Omni 1.1 Flash,強化影片生成與編輯功能。

📎 來源 (10)

Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.

  1. blog.google
  2. superpowerdaily.com
  3. google.dev
  4. digitaltrends.com
  5. google.dev
  6. blog.google
  7. daily.dev
  8. suno.bi
  9. ground.news
  10. techmeme.com
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: ITmedia AI+ (日本)

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。