
谷歌昨日宣布旗下AI影片生成模型 Gemini Omni 1.1 Flash 大幅升級,不僅能分析更長影片片段以確保視覺連貫性,更推出便宜又快速的 360p 草稿模式,顯著降低影片製作成本與技術門檻,有助於獨立創作者輕鬆產出高品質內容。
科技巨擘谷歌(Google)昨日宣布,旗下人工智慧(AI)影片生成模型 Gemini Omni 1.1 Flash 迎來重大升級。這項技術能依據文字或圖像指令,自動產出影片內容。此次更新不僅讓影片生成過程更具彈性,也顯著降低了成本,預期將對影視內容創作帶來深遠影響。
新版本在場景延伸功能上有所突破,現在可分析長達 10 秒的現有影片(先前僅能分析 1 秒),大幅提升視覺連貫性。影片場景可每次以 10 秒為單位延伸,最長可達 40 秒。此外,開發者還能上傳最多 3 秒的外部素材作為風格參考,讓 AI 在生成影片時能延續特定角色或動作模式,並可設定關鍵影格(keyframes)的起始與結束畫面,創造出更精細的運鏡效果。
為進一步優化效率與成本,Gemini Omni 1.1 Flash 新增 360p 草稿模式。此模式不僅運作速度比 720p 模式快上 60%,成本更只需其三分之一。根據《The Decoder》報導,360p 解析度的生成費用為每秒 0.03 美元,而 720p 為每秒 0.10 美元、1080p 為每秒 0.15 美元,最高階的 4K 影片生成則為每秒 0.30 美元。生成後的影片可升級至 1080p 或 4K 解析度。
這款最新的 Gemini Omni 1.1 Flash 模型已透過 Google AI Studio 及開發者文件向外界開放。Google AI Studio 是一個讓開發者能使用谷歌人工智慧模型進行原型設計的平台。這項技術的進步,預期將賦予獨立內容創作者與小型製作團隊更多資源,讓他們能以更低的門檻製作高品質影片。對於台灣眾多活躍的影音創作者而言,谷歌此舉有望開拓更多元的創作可能性,讓技術門檻與成本不再是限制創意的主要因素。
