Google 推出 Gemini Omni 模型 讓用戶輕鬆生成和編輯影片

Google 官方宣布推出 Gemini Omni,一個全新的模型,使用戶能夠從任何輸入創建各種內容。該模型的首次發佈版本 Gemini Omni Flash,讓生成和編輯影片變得如同進行對話般簡單。

Gemini Omni 的開發背景與願景

為了深入了解 Gemini Omni,Google DeepMind 團隊的三位成員——研究科學家 Mohammad Babaeizadeh、產品經理 Anish Nangia 及研究工程師 Sarah Xu,分享了他們對 Omni 的願景,並解釋為何選擇從影片生成開始。他們提到,Omni 對創作者的幫助之處在於其強大的功能。

“這個模型沒有上限。” Mohammad 說。

Google

未來的發展方向

在談及 Omni 的未來時,Sarah 表示:“它只會變得更好。”這顯示出團隊對於未來功能的信心,並暗示將會有更多創新的應用出現。

“我們的想像力可以無限發揮。”

Google

整個訪談中,團隊成員們不僅分享了技術的應用,還展現了他們的創意,探討了 Omni 可以實現的各種可能性。

資料來源:Google 官方公告

Henderson
Henderson

Henderson 是 The Base Principle 的編輯,負責 AI 與工程科技報道的選題與編輯,並監督本站的自動化編譯流程。關注範圍包括大型語言模型、半導體與運算、太空與能源工程。

The Base Principle 是一個繁體中文(香港)科技媒體,專注報道人工智能與工程前沿。我們持續追蹤 OpenAI、Anthropic Claude、Google Gemini、Grok(xAI)、Meta AI、DeepSeek 等主要 AI 模型與公司,並涵蓋電動車與工程技術趨勢,每日精選與分析。

友情網站:手機・開箱・評測 → TechRitualTechNippon 日本語版