Google が Gemini のアクティブ動画理解機能を発表

·著者 Henderson·Gemini
Google が Gemini のアクティブ動画理解機能を発表

Google は、Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite の各モデルで使用可能な新しいアクティブ動画理解機能を発表した。この機能は、動画分析の精度を向上させ、トークンの消費量とコストを大幅に削減することを目的としている。

アクティブ動画理解の機能と利点

この新機能により、モデルは動画クリップを動的にスキャンできるようになり、精度を向上させる一方で、トークンの使用量を最大 88% 削減し、コストを最大 66% 削減することが可能になる。Google DeepMind の上級製品マネージャーは、この機能の導入が動画分析に革命をもたらすだろうと述べている。

「本日発表したアクティブ動画理解機能は、分析コストを大幅に削減し、精度を向上させます。」

Google

アクティブ動画理解機能の有効化方法

ユーザーは、Google AI Studio または Gemini Enterprise Agent Platform で API 設定の構成を「agentic」にすることで、この機能を有効にすることができる。この機能は、長時間の動画処理に特によく適しており、10 分の教育動画から 90 分の講義まで、分析効率を大幅に向上させる。

「アクティブ動画理解により、Gemini モデルは視聴する内容、速度、方法を能動的に決定できるようになり、開発負担が大幅に軽減されます。」

Google

多様な応用シーン

アクティブ動画理解機能は、開発者が長時間の動画コンテンツを処理する方法を変え、素早い瞬間検索、異常検出、物体のカウントなど、さまざまな応用シーンをサポートする。これらの機能により、自動化された動画編集や複雑なクエリの実現がより実現可能になる。

「この技術は、長時間の動画分析において、トークンを大量に消費することなく、効率の大幅な向上を示しています。」

Google

将来的には、この機能は Google 製品の数十億人のユーザーに徐々に展開され、YouTube の「Ask YouTube」機能でより高品質な回答を実現することを目指している。

出典:Google 公式発表

H
著者について
Henderson