📰 重點摘要
Gemini推出Omni 1.1 Flash版本,新增一系列創作控制與生成式影片功能,透過Google AI Studio的Gemini API向開發者開放,目標是讓生成式影片工具具備更高可控性、更快的迭代速度,並符合正式產品部署的品質要求。
此次更新的核心功能有三項。第一是「場景延伸」(Scene Extension),可將現有影片從結尾處無縫接續生成後續畫面,Omni 1.1能分析長達10秒的先前畫面內容作為參考,相較舊版模型僅能參考最後1秒有大幅提升,使畫面連貫性與敘事一致性更佳;每次可延伸10秒,最多可累積延伸到總長40秒。開發者可透過Gemini API的interactions.create方法,帶入previous_interaction_id參數串接前一段影片來實現。
第二是「指定首尾影格」功能,使用者可分別設定一個鏡頭的起始與結束畫面,模型會在兩個關鍵影格之間生成連貫的過渡影片,適合用於複雜的運鏡環繞、縮放轉場或無縫循環片段等場景。
第三是360p解析度的草稿模式,相較於Omni 1.1標準的720p解析度,360p生成速度最快可提升60%,成本僅為三分之一,適合用於快速原型製作、分鏡草稿迭代與開發平台上的快速預覽渲染。
💬 JudyAI Lab 觀點
Gemini推出Omni 1.1 Flash版本,透過Google AI Studio的Gemini API開放給開發者,重點是把生成式影片的可控性與迭代速度往正式產品部署的標準推進,而不只是停留在展示層級。
這次更新值得AI builder留意的地方,在於三項功能背後共同的思路:場景延伸把參考畫面從1秒拉長到10秒、最多累積延伸到40秒,首尾影格控制讓運鏡與轉場可預期,360p草稿模式則用更低成本換取更快的迭代速度。這反映出生成式影片工具正從「一次性產出」走向「可控制、可迭代」的工作流設計——開發者不再只是丟一個prompt等結果,而是能像剪片一樣分階段接續、調整、快速試錯。對於正在把生成式AI整合進產品的團隊來說,這種「先低成本草稿、後高品質定稿」的分層設計思路值得參考。
如果你正在評估生成式影片API,不妨先想清楚:你的產品需要的是一次到位的品質,還是能反覆迭代的彈性。
📅 原文資訊
- 發布時間:2026-08-27T16:11
- 來源原文:https://deepmind.google/blog/gemini-omni-1-1-flash-lets-you-build-with-more-control/