Google Gemini 3.7 Flash: Preise verdoppeln sich ab Januar 2027
Veröffentlicht am: 20.08.2026 um 07:53 Uhr | Redaktion boerse-global.de
Google hat mit Gemini 3.7 Flash eine neue Generation seines kompakten Sprachmodells vorgestellt, die insbesondere durch eine signifikante Steigerung der Verarbeitungsgeschwindigkeit und neue Leistungsbestwerte in technischen Benchmarks hervorsticht. Das Modell wird als das derzeit schnellste System seiner Art positioniert und ist unmittelbar nach der Veröffentlichung bereits in die ersten Endanwender-Produkte des Konzerns eingeflossen.
Spitzenwerte bei Verarbeitungsgeschwindigkeit und Kodierung
In Branchenvergleichen erzielte Gemini 3.7 Flash eine Geschwindigkeit von 340,1 Tokens pro Sekunde. Damit setzte sich das Modell in Tests gegen 186 andere Modelle durch und belegt den Spitzenplatz für Anwendungen, die eine minimale Latenz erfordern. Neben der reinen Geschwindigkeit verzeichnet die neue Version deutliche Zuwächse in der Leistungsfähigkeit bei Programmier- und Automatisierungsaufgaben.
Im DeepSWE v1.1-Benchmark erreichte das Modell einen Wert von 65,3 Prozent, während die Vorgängerversion bei 49,0 Prozent lag. Ähnliche Steigerungen zeigten sich beim FrontierCode 1.1 Main mit einem Ergebnis von 43,6 Prozent gegenüber zuvor 34,4 Prozent.
Die Fähigkeiten im Bereich der Prozessautomatisierung wurden im AutomationBench mit 30,4 Prozent bewertet, was beinahe einer Verdopplung gegenüber dem Wert des Vorgängermodells von 17 Prozent entspricht. In der WebDev Arena, die die Kompetenz in der Webentwicklung misst, wurde das Modell mit 1588 Elo-Punkten eingestuft.
Zweistufiges Preismodell und Verfügbarkeit
Wer sich mit der Integration solch leistungsstarker KI-Systeme befasst, muss auch die rechtlichen Rahmenbedingungen in Europa im Blick behalten. Dieser kostenlose Umsetzungsleitfaden bietet Unternehmen einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen der EU-KI-Verordnung. EU AI Act in 5 Schritten verstehen: Jetzt E-Book kostenlos herunterladen
Für Entwickler und Unternehmen hat Google ein preislich gestaffeltes Einführungsangebot angekündigt. Bis zum 31. Dezember 2026 wird das Modell zu einem reduzierten Tarif angeboten. Die Kosten belaufen sich in diesem Zeitraum auf 0,75 US-Dollar pro Million Tokens für die Eingabe sowie 3,75 US-Dollar pro Million Tokens für die Ausgabe. Laut Unternehmensangaben entspricht dies etwa dem halben Preis des Modells 3.6 Flash.
Ab dem 1. Januar 2027 ist eine Anpassung der Gebühren vorgesehen. Die Preise sollen sich dann auf 1,50 US-Dollar pro Million Tokens (Eingabe) beziehungsweise 7,50 US-Dollar pro Million Tokens (Ausgabe) verdoppeln. Der Zugriff auf das Modell ist für professionelle Nutzer über die Plattformen Google AI Studio sowie Vertex AI möglich.
Integration in die Websuche und Funktionserweiterungen
Die rasante Entwicklung bei KI-Modellen wie Gemini stellt Verantwortliche auch vor neue Fragen zur Risikodokumentation und Kennzeichnungspflicht. Erfahren Sie in diesem praxisnahen Report, welche KI-Systeme als Hochrisiko eingestuft werden und was Unternehmen nun konkret tun müssen. Kostenlosen Leitfaden zur EU-KI-Verordnung sichern
In den vergangenen Tagen hat Google zudem damit begonnen, Gemini 3.7 Flash direkt in den sogenannten AI Mode der Websuche zu integrieren. Diese Funktion steht zunächst international für die englische Sprache zur Verfügung und richtet sich an Abonnenten der Tarife Google AI Pro und Ultra. Innerhalb der Suchoberfläche können Nutzer das Modell über ein entsprechendes Auswahlmenü für komplexe Anfragen aktivieren.
Parallel zur Einführung des neuen Modells wurden auch Updates für die Verwaltung von KI-Agenten (Managed Agents) umgesetzt. Diese beinhalten neue Schnittstellen (Hooks), die Möglichkeit zur Festlegung von Token-Budgets sowie automatisierte Auslöser (Cron-Trigger). Zudem wurde das Tarifgefüge in diesem Bereich um eine kostenlose Option ergänzt, um den Einstieg in die automatisierte Nutzung der Modelle zu erleichtern.
