Google 推出 Gemini Omni,簡化影片創作過程

Google 官方宣布,新的 AI 模型 Gemini Omni 使得影片的編輯和創作變得如同對話般簡單。這項技術讓用戶能夠輕鬆改變鏡頭角度、替換物件,甚至將簡單的草圖轉化為逼真的動畫。

Gemini Omni 的功能介紹

在今年的 I/O 大會上,Google 首次介紹了 Gemini Omni Flash,作為 Omni 系列的首個模型。Omni 使得創建和編輯影片變得極為簡單,用戶可以從文字、圖片、影片或音頻參考生成高質素的影片,甚至編輯自己的影片。由於 Omni 結合了對物理的直觀理解及 Gemini 的現實世界知識,能夠創造出更為真實的輸出。

開發者的創新應用

Google 最近向開發者開放了 Omni,並且已有多位創作者利用這項技術進行各種項目。以下是幾個引人注目的示範。

「Omni 使得編輯影片變得非常簡單。用戶可以改變鏡頭角度、切換環境,並應用電影級的縮放效果,所有這些都不會失去原始場景的脈絡。」

Google

例如,創作者 Leon Lin 利用這項功能,從約 20 種不同的角度捕捉一位女性在城市中站立的畫面,展示了她的各種角度:近距離和遠距離、正面和側面、從上方和下方拍攝,背景則隨著場景變化。

創造獨特的視覺效果

Omni 允許用戶改變影片中的情節,創造出無法用傳統方式拍攝的場景。例如,創作者 Carlos Santana 僅用聲音就改變了一個戶外場景,從白天轉為夜晚,增添了雲層和雨聲,並將樹葉變成橙色,地面覆蓋上雪。

「Omni 結合了知識與創造力,讓用戶能夠創造出符合現實邏輯的場景。」

Google

此外,創作者 Pan 利用 Omni 將草圖轉化為逼真的影片,將日常物品以趣味的方式重新詮釋,讓檸檬變成潛水艇,咖啡杯變成熱氣球等。

多樣化的應用場景

Omni 也能夠改變影片的風格和視覺效果,創造出符合用戶願景的內容。創作者 Jerrod Lew 測試了 Omni 的這項功能,將一段女性走在街道上的影片轉換成四種不同的動畫風格,流暢地從實拍轉換至動漫、黏土動畫等。

Hyperagent 團隊則利用 Omni 可視化三個不同的概念,將設計提案層疊到空蕩蕩的公園影片中,並用動畫教授解釋商業儀表板,還將待辦事項遊戲化。

用戶可以在 Gemini 應用程式、Google Flow、Google AI Studio、Gemini API 或 Gemini Enterprise Agent Platform 中體驗這項技術。

資料來源:Google 官方公告

想睇更深入嘅 AI 模型與工程科技報道?
前往 The Base Principle 繁體中文 AI 新聞 →
十斗
十斗

十斗是 TechRitual Hong Kong 科技記者,擁有計算機科學與工程學位,專注報導 AI 人工智能、Google、機器學習及數據科學領域。持續追蹤全球 AI 產業動態,為讀者提供深入淺出的科技分析。

友情網站:日本語版 / TechNipponThe Base Principle(AI・工程)