援引Google 官方部落格的消息,Google DeepMind近日正式發布了面向開發者的影片生成模型 Gemini Omni 1.1 Flash,經 Gemini API 在 Google AI Studio 中提供。初代 Gemini Omni 將真實世界推理引入生成式創作,官方稱這次的更新讓 AI 影片達到可投入專業製作的水平。

新功能集中在控制與效率兩端。場景延長允許在已有影片的結尾繼續生成畫面:模型現在可分析最多 10 秒的前文,此前只能參考最後1秒,畫面一致性與敘事連貫性因此改善;每次延長 10 秒,累計最長 40 秒。開發者還可為一組鏡頭指定起始幀與結束幀,由模型在兩個關鍵幀之間生成連續畫面,適用於環繞運鏡、縮放轉場與無縫循環素材。多模態輸入支持引用最多 3 秒的參考影片,以保持角色形象與畫面上下文一致。
效率方面,360p 草稿模式比標準 720p 生成快最多 60%,成本約為後者的三分之一,用於快速打樣與分鏡疊代,定稿後再放大至 1080p 或 4K 輸出。定價按秒計費:360p 每秒 0.03 美元,720p 0.10 美元,1080p 0.15 美元,4K 0.30 美元。定價表中還列出,Veo 3.1 Lite 720p 為每秒 0.05 美元,Veo 3.1 Fast 4K 同為 0.30 美元。

Omni 1.1 已在 Google AI Studio 與 Gemini Enterprise Agent Platform 上線;Google AI Plus、Pro、Ultra 訂閱者即日起可在 Google Flow 中使用,場景延長功能也已在 Gemini 應用中開放。Adobe 已將模型集成進 Firefly,Figma Weave、GMI Cloud 與 Runway 也已接入。






