Gemini Omni 1.1 Flash 發佈說明 / 有什麼新功能
Google DeepMind 推出了 Gemini Omni 1.1 Flash,這是一套生成式影片功能與創意控制工具,旨在讓生成式影片達到專業用途的生產力水準。此更新可透過 Google AI Studio 中的 Gemini API 使用,重點在於為開發媒體編輯軟體與創意工具的開發者提高可控性、迭代速度與輸出品質。
增強型場景延伸以維持敘事一致性
Gemini Omni 1.1 Flash 允許使用者無縫地延伸現有的影片片段。該模型現在可以分析多達 10 秒的前文脈絡——這與先前僅參考最後一秒的模型相比有了顯著提升——以改善視覺一致性與敘事遵循度。
影片可以以 10 秒為增量進行延伸,總累計長度可達 40 秒。
透過影格插值實現精確的動作控制
Omni 1.1 能夠指定鏡頭的起始與結束影格。模型會在兩個關鍵影格之間生成連續的影片,這有助於在不產生跳接的情況下,建立複雜的攝影機軌道運動、縮放轉換與無縫循環片段。
使用 360p 草稿進行優化的原型設計
為了加速迭代過程,Omni 1.1 支援生成 360p 解析度的輕量級預覽。這些草稿的生成速度比標準 720p 解析度快上 60%,且成本僅為其三分之一,非常適合快速原型設計與分鏡腳本迭代。
專業解析度與放大技術
Omni 1.1 支援可供專業製作使用的解析度輸出,並具備將影片放大至 1080p 或 4K 解析度的能力。
多模態影片參考
開發者現在可以將多達 3 秒的影片作為多模態輸入的一部分。這讓模型在生成新內容時,能透過參考上傳影片檔案中的特定動作或場景,來維持角色一致性與視覺脈絡。
可用性與整合
Gemini Omni 1.1 Flash 可透過多個 Google 平台使用:
- Google AI Studio: 直接存取以進行開發與測試。
- Gemini Enterprise Agent Platform: 為企業開發者提供部署選項。
- Google Flow: 提供給 Google AI Plus, Pro, 與 Ultra 訂閱者使用。
- Gemini App: 全球 Google AI Plus, Pro, 與 Ultra 訂閱者皆可使用場景延伸功能。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch