Google DeepMind lanza la comprensión de video agéntica para los modelos Gemini
Google DeepMind anunció el lanzamiento de la comprensión de video agéntica para sus modelos Gemini, incluidos Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite. La función está disponible a través de la API de Gemini en Google AI Studio y en la plataforma Gemini Enterprise Agent. Utiliza herramientas de video nativas para buscar, escanear e inspeccionar dinámicamente segmentos de video, reduciendo el consumo de tokens hasta en un 88%, los costos hasta en un 66% y mejorando la precisión hasta en un 7% en los puntos de referencia estándar. La función es particularmente beneficiosa para el análisis de videos de larga duración. También se implementará en la aplicación Gemini y alimentará la función 'Preguntar a YouTube' en los próximos meses.
Comentarios 0
Debate este evento en hilos permanentes. El chat en vivo es independiente.
Lo que sabemos
La función está disponible a través de la API de Gemini en Google AI Studio y la Plataforma de Agentes Empresariales de Gemini.
▤ 1 fuentes›
La comprensión de video agéntica reduce el consumo de tokens hasta en un 88% y los costos hasta en un 66%.
▤ 1 fuentes›
La función se implementará en la aplicación Gemini y alimentará la función 'Ask YouTube' de YouTube.
▤ 1 fuentes›
Google DeepMind lanzó comprensión de video agéntica para Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite.
▤ 1 fuentes›
La precisión mejora hasta en un 7% en los puntos de referencia estándar de análisis de video.
▤ 1 fuentes›
Sin tarifa adicional por la función; utiliza el precio estándar de tokens de la API de Gemini.
▤ 1 fuentes›
Google DeepMind anunció el lanzamiento de la comprensión de video agéntica para Gemini 3.7 Flash, 3.6 Flash y 3.5 Flash-Lite, afirmando una reducción de tokens de hasta el 88%, una reducción de costos del 66% y una mejora en la precisión del 7%.
Verificado · 1 fuentes
Aún no hay comentarios. Inicia la conversación.