Google DeepMind lanceert agentische videobegrip voor Gemini-modellen
Google DeepMind heeft de lancering aangekondigd van agentische videobegrip voor zijn Gemini-modellen, waaronder Gemini 3.7 Flash, 3.6 Flash en 3.5 Flash-Lite. De functie is beschikbaar via de Gemini API in Google AI Studio en het Gemini Enterprise Agent Platform. Het maakt gebruik van native videotools om videosegmenten dynamisch te doorzoeken, scannen en inspecteren, waardoor het tokenverbruik met tot 88%, de kosten met tot 66% wordt verminderd en de nauwkeurigheid op standaard benchmarks met tot 7% wordt verbeterd. De functie is met name nuttig voor analyse van lange video's. Het zal ook worden uitgerold naar de Gemini-app en in de komende maanden YouTube's 'Ask YouTube'-functie aandrijven.
Reacties 0
Bespreek dit evenement in blijvende threads. Livechat blijft apart.
Wat we weten
De functie is beschikbaar via de Gemini API in Google AI Studio en het Gemini Enterprise Agent Platform.
▤ 1 bronnen›
Agentische videobegrip vermindert het tokenverbruik met tot 88% en de kosten met tot 66%.
▤ 1 bronnen›
De functie wordt uitgerold naar de Gemini-app en zal YouTube's 'Ask YouTube'-functie ondersteunen.
▤ 1 bronnen›
Google DeepMind heeft agentische videobegrip gelanceerd voor Gemini 3.7 Flash, 3.6 Flash en 3.5 Flash-Lite.
▤ 1 bronnen›
De nauwkeurigheid verbetert met tot 7% op standaard videoanalyse-benchmarks.
▤ 1 bronnen›
Geen extra functiekosten; gebruikt standaard Gemini API-tokenprijzen.
▤ 1 bronnen›
Google DeepMind heeft de lancering aangekondigd van agentische videobegrip voor Gemini 3.7 Flash, 3.6 Flash en 3.5 Flash-Lite, met beweringen van tot 88% tokenreductie, 66% kostenreductie en 7% nauwkeurigheidsverbetering.
Geverifieerd · 1 bronnen
Nog geen reacties. Begin het gesprek.