DoseFix LIVE
0Stimmen
KI·Vereinigte Staaten·BESTÄTIGT

Google DeepMind führt agentisches Video-Verständnis für Gemini-Modelle ein

Vereinigte Staaten·
DoseFix EditorialSynthese aus mehreren Quellen

Google DeepMind kündigte die Einführung von agentischem Video-Verständnis für seine Gemini-Modelle an, einschließlich Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite. Die Funktion ist über die Gemini API in Google AI Studio und die Gemini Enterprise Agent Platform verfügbar. Sie nutzt native Video-Tools, um Videosegmente dynamisch zu durchsuchen, zu scannen und zu inspizieren, wodurch der Token-Verbrauch um bis zu 88%, die Kosten um bis zu 66% gesenkt und die Genauigkeit bei Standard-Benchmarks um bis zu 7% verbessert wird. Die Funktion ist besonders vorteilhaft für die Analyse langer Videos. Sie wird auch in der Gemini-App eingeführt und in den kommenden Monaten die YouTube-Funktion 'Ask YouTube' unterstützen.

Automatisch übersetzt · EN
1 Quellen
Vereinigte Staaten

Kommentare 0

Diskutiere dieses Ereignis in dauerhaften Threads. Der Live-Chat bleibt getrennt.

Bleib respektvoll und trenne Meinungen von verifizierten Informationen.

Noch keine Kommentare. Starte die Diskussion.

Was wir wissen

Die Funktion ist über die Gemini-API in Google AI Studio und der Gemini Enterprise Agent Platform verfügbar.

1 Quellen

Agentisches Video-Verständnis reduziert den Token-Verbrauch um bis zu 88 % und die Kosten um bis zu 66 %.

1 Quellen

Die Funktion wird in der Gemini-App eingeführt und die Funktion „Ask YouTube“ von YouTube unterstützen.

1 Quellen

Google DeepMind hat agentisches Video-Verständnis für Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite eingeführt.

1 Quellen

Die Genauigkeit verbessert sich um bis zu 7 % bei Standard-Benchmarks zur Videoanalyse.

1 Quellen

Keine zusätzliche Funktionsgebühr; verwendet die Standard-Token-Preise der Gemini-API.

1 Quellen
Zeitleiste der Einführung des agentischen Video-Verständnisses

Google DeepMind kündigte die Einführung von agentischem Video-Verständnis für Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite an und behauptet eine Token-Reduktion von bis zu 88%, Kostensenkung von 66% und Genauigkeitsverbesserung von 7%.

Verifiziert · 1 Quellen

Live-Berichte

Alle ansehen
Zeitleiste der Einführung des agentischen Video-VerständnissesLokale Stimme · Vereinigte Staaten
Verifiziert
Google DeepMind führt agentisches Video-Verständnis für Gemini-Modelle ein | DoseFix