Google DeepMind、Geminiモデル向けエージェント型ビデオ理解を発表
Google DeepMindは、Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Liteを含むGeminiモデル向けに、エージェント型ビデオ理解の提供開始を発表しました。この機能は、Google AI StudioのGemini APIとGemini Enterprise Agent Platformで利用できます。ネイティブビデオツールを使用して、ビデオセグメントを動的に検索、スキャン、検査し、トークン消費を最大88%、コストを最大66%削減し、標準ベンチマークでの精度を最大7%向上させます。この機能は、長尺ビデオ分析に特に有益です。また、今後数か月以内にGeminiアプリにも展開され、YouTubeの「Ask YouTube」機能を強化します。
コメント 0
この出来事を保存されるスレッドで議論できます。ライブチャットとは別です。
判明していること
この機能は、Google AI StudioのGemini APIおよびGemini Enterprise Agent Platformで利用できます。
▤ 1 ソース›
エージェント型ビデオ理解により、トークン消費量が最大88%削減され、コストが最大66%削減されます。
▤ 1 ソース›
この機能はGeminiアプリに展開され、YouTubeの「Ask YouTube」機能を強化します。
▤ 1 ソース›
Google DeepMindは、Gemini 3.7 Flash、3.6 Flash、および3.5 Flash-Lite向けにエージェント型ビデオ理解を開始しました。
▤ 1 ソース›
標準的なビデオ分析ベンチマークで、精度が最大7%向上します。
▤ 1 ソース›
追加の機能料金はなく、標準のGemini APIトークン価格を使用します。
▤ 1 ソース›
Google DeepMindは、Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite向けのエージェント型ビデオ理解の提供開始を発表し、最大88%のトークン削減、66%のコスト削減、7%の精度向上を主張しています。
検証済み · 1 ソース
まだコメントはありません。会話を始めましょう。