teurer, aber Google plant, es für alles zu verwenden
Gemini 3.5 Flash: teurer, aber Google plant, es für alles zu verwenden
19. Mai 2026
Heute hat Google auf der Google I/O Gemini 3.5 Flash veröffentlicht. Dieser hat das übersprungen -preview Modifikator und ging direkt zur allgemeinen Verfügbarkeit über, und Google scheint ihn für eine ganze Reihe seiner wichtigsten Produkte zu verwenden:
3.5 Flash ist heute für Milliarden von Menschen weltweit verfügbar:
- Für alle über die Gemini-App und den AI-Modus in der Google-Suche
- Für Entwickler unserer Agent-First-Entwicklungsplattform Google Antigravity und Gemini API in Google AI Studio und Android Studio
- Für Unternehmen in Gemini Enterprise Agent Platform und Gemini Enterprise.
Wie bei Gemini üblich, sind die interessantesten Details in der Entwicklerdokumentation „Was ist neu in Gemini 3.5 Flash“ versteckt. Es verfügt größtenteils über die gleichen Plattformfunktionen wie die vorherige Gemini 3.x-Serie, allerdings ohne Computernutzung. Die Modell-ID lautet gemini-3.5-flash. Der Wissensstichtag ist Januar 2025 und es werden 1.048.576 Eingabe-Tokens und 65.536 maximale Ausgabe-Tokens unterstützt.
Google bringt auch eine neue Interaktions-API voran, die sich derzeit in der Betaphase befindet und meiner Meinung nach wie ihre Version der von OpenAI Responses eingeführten Muster aussieht – insbesondere die serverseitige Verlaufsverwaltung.
Der Preis ist gestiegen
Gemini 3.5 Flash geht mit einem deutlichen Preisanstieg einher. Die Vorgängermodelle der „Flash“-Familie waren Gemini 3 Flash Preview und Gemini 3.1 Flash-Lite. Das neue 3.5 Flash ist dreimal so teuer wie 3 Flash Preview und sechsmal so teuer wie 3.1 Flash-Lite (siehe Preisvergleich hier).
Mit 1,50 US-Dollar pro Million Input und 9 US-Dollar pro Million Output kommt es dem Preis von Googles Gemini 3.1 Pro nahe, der bei 2 US-Dollar und 12 US-Dollar liegt.
Das Gemini-Team verspricht, dass 3.5 Pro „nächsten Monat“ auf den Markt kommt – voraussichtlich zu einem noch höheren Preis.
Dies passt zu einem Trend: GPT-5.5 von OpenAI war doppelt so teuer wie GPT-5.4, und Claude Opus 4.7 kostet etwa das 1,46-fache von 4.6, wenn man den neuen Tokenizer berücksichtigt.
Angesichts der Preiserhöhung ist es interessant zu sehen, wie Google es für so viele seiner eigenen kostenlosen Produkte einführt. Es scheint, als würden alle drei großen KI-Labore damit beginnen, die Preistoleranz ihrer API-Kunden auszuloten.
Artificial Analysis veröffentlicht die Kosten für die Durchführung ihres proprietären Benchmarks mit Modellen. Dies ist eine nützliche Möglichkeit, Dinge wie Tokenisierung und ein erhöhtes Volumen an Reasoning-Tokens zu berücksichtigen. Einige Zahlen, die einen Vergleich lohnen:
Das Ausführen des Benchmarks für 3.5 Flash (hoch) kostete deutlich mehr als 3.1 Pro Preview!
Hier einige Zahlen anderer Anbieter:
Ein Pelikan auf einem Fahrrad
Ich habe „Generiere ein SVG eines Pelikans, der Fahrrad fährt“ gegen die Gemini-API ausgeführt und diesen Pelikan zurückbekommen, der ein ist viel:

Aus den Codekommentaren:
Igel auf Hacker News:
Dieser Pelikan scheint für eine Krypto-Konferenz in Miami zu sein.
Das hat mich 11 Input-Tokens und 14.403 Output-Tokens gekostet, also insgesamt knapp 13 Cent.
