Google DeepMind führt agentisches Video-Verständnis für Gemini-Modelle ein
Google DeepMind kündigte die Einführung von agentischem Video-Verständnis für seine Gemini-Modelle an, einschließlich Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite. Die Funktion ist über die Gemini API in Google AI Studio und die Gemini Enterprise Agent Platform verfügbar. Sie nutzt native Video-Tools, um Videosegmente dynamisch zu durchsuchen, zu scannen und zu inspizieren, wodurch der Token-Verbrauch um bis zu 88%, die Kosten um bis zu 66% gesenkt und die Genauigkeit bei Standard-Benchmarks um bis zu 7% verbessert wird. Die Funktion ist besonders vorteilhaft für die Analyse langer Videos. Sie wird auch in der Gemini-App eingeführt und in den kommenden Monaten die YouTube-Funktion 'Ask YouTube' unterstützen.
Kommentare 0
Diskutiere dieses Ereignis in dauerhaften Threads. Der Live-Chat bleibt getrennt.
Was wir wissen
Die Funktion ist über die Gemini-API in Google AI Studio und der Gemini Enterprise Agent Platform verfügbar.
▤ 1 Quellen›
Agentisches Video-Verständnis reduziert den Token-Verbrauch um bis zu 88 % und die Kosten um bis zu 66 %.
▤ 1 Quellen›
Die Funktion wird in der Gemini-App eingeführt und die Funktion „Ask YouTube“ von YouTube unterstützen.
▤ 1 Quellen›
Google DeepMind hat agentisches Video-Verständnis für Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite eingeführt.
▤ 1 Quellen›
Die Genauigkeit verbessert sich um bis zu 7 % bei Standard-Benchmarks zur Videoanalyse.
▤ 1 Quellen›
Keine zusätzliche Funktionsgebühr; verwendet die Standard-Token-Preise der Gemini-API.
▤ 1 Quellen›
Google DeepMind kündigte die Einführung von agentischem Video-Verständnis für Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite an und behauptet eine Token-Reduktion von bis zu 88%, Kostensenkung von 66% und Genauigkeitsverbesserung von 7%.
Verifiziert · 1 Quellen
Noch keine Kommentare. Starte die Diskussion.