Gemini, Video

Gemini Video: Google spart 88% Token-Kosten mit agentic AI

Veröffentlicht am: 02.09.2026 um 11:52 Uhr | Redaktion boerse-global.de

Googles agentische Videoanalyse senkt den Tokenbedarf um bis zu 88 Prozent und die Kosten um bis zu 66 Prozent bei höherer Genauigkeit.

Google Gemini analysiert Videos effizienter und günstiger
Moderne Server-Racks in einem Rechenzentrum zur Veranschaulichung effizienter KI-Videoanalyse. Illustration mit AI erstellt.

Google hat eine technologische Neuerung für seine Gemini-Modellfamilie vorgestellt, die die Effizienz der KI-gestützten Videoanalyse grundlegend verändern soll. Mit der Einführung des sogenannten „agentic video understanding“ für die Modelle Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite setzt das Unternehmen auf ein Verfahren, das Videodaten nicht mehr linear, sondern selektiv verarbeitet.

Effizienzsteigerung durch selektive Segmentanalyse

Bisherige Methoden der Video-KI basierten häufig auf einer starren Analyse, bei der eine feste Anzahl von Bildern pro Sekunde – in der Regel ein Bild (1 FPS) – verarbeitet wurde. Der neue agentische Ansatz bricht mit diesem Standard. Statt das gesamte Material gleichmäßig zu scannen, identifiziert das Modell gezielt die Videosegmente, die für die Beantwortung einer spezifischen Anfrage relevant sind.

Diese selektive Vorgehensweise hat laut Unternehmensangaben massive Auswirkungen auf den Ressourcenverbrauch. Google berichtet von einer Reduktion des Token-Verbrauchs um bis zu 88 %. Da die Abrechnung von KI-Diensten maßgeblich auf der Anzahl der verarbeiteten Token basiert, führt dies zu einer deutlichen Kostenersparnis für Anwender. Die Kosten für die Videoanalyse sollen durch das neue Verfahren um bis zu 66 % sinken.

Höhere Genauigkeit trotz Datenreduktion

Trotz der drastischen Reduzierung der zu verarbeitenden Datenmenge führt die gezielte Analyse offenbar zu qualitativ besseren Ergebnissen. In Tests auf dem Referenzwert „LongVideoBench“ konnte die Genauigkeit der Modelle um bis zu 7 % gesteigert werden.

Anzeige

Wer sich mit dem Einsatz solch innovativer KI-Systeme befasst, muss auch die rechtlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Umsetzungsleitfaden bietet Unternehmen einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen der EU-KI-Verordnung. EU AI Act in 5 Schritten verstehen

Google DeepMind ordnet insbesondere das Modell Gemini 3.7 Flash aufgrund dieser Werte an die Spitze des Marktes ein. Das Modell biete derzeit die beste Kombination aus Präzision und Kosteneffizienz im Bereich des agentischen Video-Verständnisses.

Integration und Verfügbarkeit für Entwickler

Die neue Funktion wurde bereits für professionelle Anwender freigeschaltet. Sie ist über die Gemini API im Google AI Studio sowie über die Gemini Enterprise Agent Platform zugänglich. Entwickler können den Modus direkt ansteuern, indem sie in ihren Konfigurationen den Befehl „processing: agentic“ hinterlegen. Das System unterstützt dabei sowohl direkt hochgeladene Videodateien als auch die Analyse über YouTube-URLs.

Anzeige

Die Entwicklung und Vermarktung neuer KI-Technologien unterliegt seit August 2024 strengen Regeln zur Risikodokumentation und Qualitätssicherung. Erfahren Sie in diesem kostenlosen Report, welche Systeme als Hochrisiko gelten und wie Sie die Compliance in Ihrem Unternehmen sicherstellen. Kostenlosen Umsetzungsleitfaden zum EU AI Act sichern

Hinsichtlich der Preisgestaltung gibt es keine Änderungen für die Nutzer des neuen Modus. Laut vorliegenden Informationen werden keine Zusatzgebühren erhoben; es gelten weiterhin die Standard-Preise für die Nutzung der jeweiligen Gemini-Flash-Modelle.

Geplante Erweiterung für Endnutzer

Während die Funktion derzeit primär auf die Entwickler-Ebene zielt, bereitet Google bereits die Integration in Produkte für Endkonsumenten vor. Geplant ist ein Rollout des agentischen Video-Verständnisses innerhalb der regulären Gemini-App.

Zudem soll die Funktion in das YouTube-Feature „Ask YouTube“ einfließen, womit Nutzer künftig in der Lage sein werden, komplexe Fragen zu Videoinhalten zu stellen, die von der KI effizienter und präziser als bisher beantwortet werden können.

Disclaimer...

de | wissenschaft | 70042418 |