Google 官方宣布,新的 AI 模型 Gemini Omni 使得影片的編輯和創作變得如同對話般簡單。這項技術讓用戶能夠輕鬆改變鏡頭角度、替換物件,甚至將簡單的草圖轉化為逼真的動畫。
Gemini Omni 的功能介紹
在今年的 I/O 大會上,Google 首次介紹了 Gemini Omni Flash,作為 Omni 系列的首個模型。Omni 使得創建和編輯影片變得極為簡單,用戶可以從文字、圖片、影片或音頻參考生成高質素的影片,甚至編輯自己的影片。由於 Omni 結合了對物理的直觀理解及 Gemini 的現實世界知識,能夠創造出更為真實的輸出。
開發者的創新應用
Google 最近向開發者開放了 Omni,並且已有多位創作者利用這項技術進行各種項目。以下是幾個引人注目的示範。
「Omni 使得編輯影片變得非常簡單。用戶可以改變鏡頭角度、切換環境,並應用電影級的縮放效果,所有這些都不會失去原始場景的脈絡。」
Google
例如,創作者 Leon Lin 利用這項功能,從約 20 種不同的角度捕捉一位女性在城市中站立的畫面,展示了她的各種角度:近距離和遠距離、正面和側面、從上方和下方拍攝,背景則隨著場景變化。
創造獨特的視覺效果
Omni 允許用戶改變影片中的情節,創造出無法用傳統方式拍攝的場景。例如,創作者 Carlos Santana 僅用聲音就改變了一個戶外場景,從白天轉為夜晚,增添了雲層和雨聲,並將樹葉變成橙色,地面覆蓋上雪。
「Omni 結合了知識與創造力,讓用戶能夠創造出符合現實邏輯的場景。」
Google
此外,創作者 Pan 利用 Omni 將草圖轉化為逼真的影片,將日常物品以趣味的方式重新詮釋,讓檸檬變成潛水艇,咖啡杯變成熱氣球等。
多樣化的應用場景
Omni 也能夠改變影片的風格和視覺效果,創造出符合用戶願景的內容。創作者 Jerrod Lew 測試了 Omni 的這項功能,將一段女性走在街道上的影片轉換成四種不同的動畫風格,流暢地從實拍轉換至動漫、黏土動畫等。
Hyperagent 團隊則利用 Omni 可視化三個不同的概念,將設計提案層疊到空蕩蕩的公園影片中,並用動畫教授解釋商業儀表板,還將待辦事項遊戲化。
用戶可以在 Gemini 應用程式、Google Flow、Google AI Studio、Gemini API 或 Gemini Enterprise Agent Platform 中體驗這項技術。
資料來源:Google 官方公告

