Google DeepMind lance la compréhension vidéo agentique pour les modèles Gemini
Google DeepMind a annoncé le lancement de la compréhension vidéo agentique pour ses modèles Gemini, notamment Gemini 3.7 Flash, 3.6 Flash et 3.5 Flash-Lite. La fonctionnalité est disponible via l'API Gemini dans Google AI Studio et sur la plateforme Gemini Enterprise Agent. Elle utilise des outils vidéo natifs pour rechercher, scanner et inspecter dynamiquement des segments vidéo, réduisant la consommation de jetons jusqu'à 88 %, les coûts jusqu'à 66 % et améliorant la précision jusqu'à 7 % sur les benchmarks standard. La fonctionnalité est particulièrement bénéfique pour l'analyse de vidéos longues. Elle sera également déployée dans l'application Gemini et alimentera la fonctionnalité « Demander à YouTube » dans les prochains mois.
Commentaires 0
Discutez de cet événement dans des fils persistants. Le direct reste séparé.
Ce que nous savons
La fonctionnalité est disponible via l'API Gemini dans Google AI Studio et la plateforme Gemini Enterprise Agent.
▤ 1 sources›
La compréhension vidéo agentique réduit la consommation de jetons jusqu'à 88 % et les coûts jusqu'à 66 %.
▤ 1 sources›
La fonctionnalité sera déployée dans l'application Gemini et alimentera la fonctionnalité « Ask YouTube » de YouTube.
▤ 1 sources›
Google DeepMind a lancé la compréhension vidéo agentique pour Gemini 3.7 Flash, 3.6 Flash et 3.5 Flash-Lite.
▤ 1 sources›
La précision s'améliore jusqu'à 7 % sur les benchmarks standard d'analyse vidéo.
▤ 1 sources›
Aucun frais de fonctionnalité supplémentaire ; utilise la tarification standard des jetons de l'API Gemini.
▤ 1 sources›
Google DeepMind a annoncé le lancement de la compréhension vidéo agentique pour Gemini 3.7 Flash, 3.6 Flash et 3.5 Flash-Lite, affirmant une réduction des jetons allant jusqu'à 88 %, une réduction des coûts de 66 % et une amélioration de la précision de 7 %.
Vérifié · 1 sources
Aucun commentaire. Lancez la discussion.