Google推出新一代AI影片生成與編輯模型Gemini Omni 1.1 Flash,不僅能用文字、圖片及影片生成畫面,還可讓影片接著演、指定首尾畫面控制轉場,並輸出最高4K畫質。Gemini Omni 1.1 Flash有哪些新功能?哪些人能用?《NOWNEWS今日新聞》一次整理。

我是廣告 請繼續往下閱讀
Gemini Omni 1.1 Flash是什麼?

是Google旗下新一代多模態AI影片生成與編輯模型,使用者可以輸入文字指令,或提供圖片、影片等素材,讓AI生成新影片,完成後還能繼續用對話方式調整,例如要求「讓鏡頭向右移動」、「替畫面加入一隻狗」或「讓這段影片接著演下去」,操作概念就像透過文字指揮一名AI剪輯師。

Gemini Omni 1.1 Flash有什麼功能?5大升級一次看

1.影片能最長延伸至40秒

Gemini Omni 1.1 Flash可以分析既有影片前段最多10秒的內容,再從影片結尾繼續生成新畫面。每次最多延伸10秒,透過多次延伸後,影片累計長度最長可達40秒。

2. AI自動完成轉場

使用者可以分別提供影片的起始畫面與結束畫面,再由AI補上中間過程。例如第一張圖片是人物站在室內,最後一張是在戶外,模型就能生成一段連續運鏡,讓兩個場景自然銜接。

3.支援文字、圖片及影片生成

Gemini Omni 1.1 Flash可直接將文字描述變成影片,也能讓一張靜態照片動起來,或以現有影片為基礎進行修改。由於模型具備Gemini的多模態理解及現實世界知識,除了讀懂畫面,也會嘗試依照物理規則及情節邏輯安排人物與物體動作。

4.用聊天方式修改影片

影片生成後,如果成果不符合需求,不必全部重做,使用者可以繼續輸入指令調整,包括更換人物服裝、刪除物件、改變天氣、修改動作或轉換影像風格。

5.完成後輸出4K

Gemini Omni 1.1 Flash支援360p、720p、1080p及4K等解析度,影片幀率為24fps。創作者可先用成本較低、生成速度較快的360p版本確認構圖與動作,定稿後再升級輸出4K影片。

哪些人可以使用?

Gemini Omni目前主要提供以下3類使用者:

·  一般用戶:Google AI Plus、Pro及Ultra訂閱者,可透過Gemini App與Google Flow使用Omni系列影片功能。 

·  開發者:可在Google AI Studio測試,或透過Gemini API將影片生成及編輯能力加入自家App或服務。 

·  企業用戶:可透過Gemini Enterprise Agent Platform導入相關功能

台灣可以使用嗎?

Google公布的支援地區名單中,台灣已列入Google AI Studio及Gemini API的開放範圍,台灣用戶可透過開發者平台使用,不過新功能可能採分批推送,若在Gemini App或Google Flow尚未看到相關選項,可能需要等待帳號更新。開發者透過Gemini API使用則需要付費,目前沒有免費額度。依Google官方價格表,720p影片輸出換算成本約為每秒0.10美元,實際費用仍會依輸出長度、解析度及使用量而定。


周淑萍編輯記者

現為《NOWnews今日新聞》資深記者,主跑科技、醫療。

記者經歷從《蘋果日報》為起點,同時伴隨著iPhone發展史,從蘋果 iPhone 3 開始持續到現在,每一代、每一年推出的iPhone 都沒錯過。信仰加值的每一年,除...