Google 推出 Gemini Omni,簡化影片創作過程

Google 官方宣布,新的 AI 模型 Gemini Omni 使得影片的編輯和創作變得如同對話般簡單。這項技術讓用戶能夠輕鬆改變鏡頭角度、替換物件,甚至將簡單的草圖轉化為逼真的動畫。

Gemini Omni 的功能介紹

在今年的 I/O 大會上,Google 首次介紹了 Gemini Omni Flash,作為 Omni 系列的首個模型。Omni 使得創建和編輯影片變得極為簡單,用戶可以從文字、圖片、影片或音頻參考生成高質素的影片,甚至編輯自己的影片。由於 Omni 結合了對物理的直觀理解及 Gemini 的現實世界知識,能夠創造出更為真實的輸出。

開發者的創新應用

Google 最近向開發者開放了 Omni,並且已有多位創作者利用這項技術進行各種項目。以下是幾個引人注目的示範。

「Omni 使得編輯影片變得非常簡單。用戶可以改變鏡頭角度、切換環境,並應用電影級的縮放效果,所有這些都不會失去原始場景的脈絡。」

Google

例如,創作者 Leon Lin 利用這項功能,從約 20 種不同的角度捕捉一位女性在城市中站立的畫面,展示了她的各種角度:近距離和遠距離、正面和側面、從上方和下方拍攝,背景則隨著場景變化。

創造獨特的視覺效果

Omni 允許用戶改變影片中的情節,創造出無法用傳統方式拍攝的場景。例如,創作者 Carlos Santana 僅用聲音就改變了一個戶外場景,從白天轉為夜晚,增添了雲層和雨聲,並將樹葉變成橙色,地面覆蓋上雪。

「Omni 結合了知識與創造力,讓用戶能夠創造出符合現實邏輯的場景。」

Google

此外,創作者 Pan 利用 Omni 將草圖轉化為逼真的影片,將日常物品以趣味的方式重新詮釋,讓檸檬變成潛水艇,咖啡杯變成熱氣球等。

多樣化的應用場景

Omni 也能夠改變影片的風格和視覺效果,創造出符合用戶願景的內容。創作者 Jerrod Lew 測試了 Omni 的這項功能,將一段女性走在街道上的影片轉換成四種不同的動畫風格,流暢地從實拍轉換至動漫、黏土動畫等。

Hyperagent 團隊則利用 Omni 可視化三個不同的概念,將設計提案層疊到空蕩蕩的公園影片中,並用動畫教授解釋商業儀表板,還將待辦事項遊戲化。

用戶可以在 Gemini 應用程式、Google Flow、Google AI Studio、Gemini API 或 Gemini Enterprise Agent Platform 中體驗這項技術。

資料來源:Google 官方公告

Henderson
Henderson

Henderson 是 The Base Principle 的編輯,負責 AI 與工程科技報道的選題與編輯,並監督本站的自動化編譯流程。關注範圍包括大型語言模型、半導體與運算、太空與能源工程。

The Base Principle 是一個繁體中文(香港)科技媒體,專注報道人工智能與工程前沿。我們持續追蹤 OpenAI、Anthropic Claude、Google Gemini、Grok(xAI)、Meta AI、DeepSeek 等主要 AI 模型與公司,並涵蓋電動車與工程技術趨勢,每日精選與分析。

友情網站:手機・開箱・評測 → TechRitualTechNippon 日本語版