Google DeepMind запускает агентное понимание видео для моделей Gemini
Google DeepMind объявил о запуске агентного понимания видео для своих моделей Gemini, включая Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite. Функция доступна через Gemini API в Google AI Studio и Gemini Enterprise Agent Platform. Она использует нативные видеоинструменты для динамического поиска, сканирования и проверки видеосегментов, сокращая потребление токенов до 88%, затраты до 66% и повышая точность до 7% на стандартных бенчмарках. Функция особенно полезна для анализа длинных видео. В ближайшие месяцы она также появится в приложении Gemini и будет обеспечивать функцию YouTube 'Ask YouTube'.
Комментарии 0
Обсуждайте событие в постоянных ветках. Онлайн-чат остаётся отдельно.
Что мы знаем
Функция доступна через Gemini API в Google AI Studio и на платформе Gemini Enterprise Agent.
▤ 1 источники›
Агентное понимание видео снижает потребление токенов до 88% и затраты до 66%.
▤ 1 источники›
Функция будет внедрена в приложение Gemini и обеспечит работу функции YouTube 'Ask YouTube'.
▤ 1 источники›
Google DeepMind запустил агентное понимание видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite.
▤ 1 источники›
Точность улучшается до 7% на стандартных бенчмарках анализа видео.
▤ 1 источники›
Дополнительная плата за функцию не взимается; используется стандартное ценообразование токенов Gemini API.
▤ 1 источники›
Google DeepMind объявил о запуске агентного понимания видео для Gemini 3.7 Flash, 3.6 Flash и 3.5 Flash-Lite, заявляя о сокращении токенов до 88%, снижении затрат на 66% и повышении точности на 7%.
Проверено · 1 источники
Комментариев пока нет. Начните обсуждение.