
Google は、Gemini 3.7 Flash、Gemini 3.6 Flash、および Gemini 3.5 Flash-Lite にエージェントベースのビデオ分析を追加します。固定頻度でフレームをスキャンするのではなく、システム自体が調査するフラグメントと解像度を選択します。
Google の発表によると、このアプローチはトークン使用量を最大 88% 削減し、特に数時間に及ぶ映像を扱う際に精度を向上させます。これらのデータは The Decoder によって公開されたものであり、提供されたパッケージにはメタデータと記事の概要のみが含まれています。
この変更の実践的な意義は、分析対象となるデータ量を減らしつつ、長時間のビデオを処理できるようになる点にあります。ただし、情報源は測定の条件、テストセット、精度の絶対値については開示していません。
編集部コメント
なぜ重要か
予想される帰結は、数時間に及ぶビデオのより経済的な処理です。次に検証すべき指標は、Google によって公開されるテスト手法と実素材における結果であり、主要な不確実性要因は、利用可能な概要にそうした詳細が欠如している点に残っています。