Google hat drei neue KI-Modelle vorgestellt: Gemini 3.6 Flash, 3.5 Flash-Lite und 3.5 Flash Cyber. Alle drei gehören zur Flash-Reihe, die auf günstige, schnelle und effiziente KI-Agenten ausgelegt ist – und nicht auf maximale Denkleistung. Angekündigt wurden die Modelle am 21. Juli 2026 von Tulsee Doshi aus dem Gemini-Team.
Das Wichtigste in Kürze
- Gemini 3.6 Flash ist das neue Standardmodell und arbeitet 17 Prozent token-effizienter als 3.5 Flash – bei niedrigerem Preis.
- Gemini 3.5 Flash-Lite ist mit 350 Tokens pro Sekunde das schnellste 3.5-Modell und für hohe Volumina gedacht.
- Gemini 3.5 Flash Cyber spürt Sicherheitslücken auf, ist aber vorerst nur für Behörden und ausgewählte Partner verfügbar.
- Ein 3.5 Pro fehlt noch, befindet sich aber im Partner-Test. Parallel läuft bereits das Training von Gemini 4.
Gemini 3.6 Flash: mehr Leistung bei weniger Tokens
Gemini 3.6 Flash baut direkt auf dem Feedback zu 3.5 Flash auf. Der wichtigste Fortschritt liegt in der Effizienz: Laut dem Artificial Analysis Index verbraucht das Modell 17 Prozent weniger Output-Tokens als sein Vorgänger, im Coding-Benchmark DeepSWE sind es sogar bis zu 65 Prozent. Weniger Tokens bedeuten für Entwickler direkt niedrigere Kosten pro Aufgabe.

Gleichzeitig steigt die Qualität. Beim Programmieren erreicht 3.6 Flash in DeepSWE 49 statt 37 Prozent, bei der Computernutzung (OSWorld-Verified) 83,0 statt 78,4 Prozent. Auch in der Wissensarbeit legt das Modell zu, etwa bei der Analyse von Dokumenten und Diagrammen. Die Computernutzung ist jetzt als eingebautes Tool über die Gemini-API verfügbar. Ähnlich tief verzahnt Google seine KI bereits bei Gemini Omni in Google Vids.
Gemini 3.5 Flash-Lite: gebaut für Tempo und Masse
Flash-Lite ist das schnellste Modell der 3.5-Reihe und mit 350 Output-Tokens pro Sekunde für Aufgaben gedacht, bei denen Durchsatz zählt – etwa agentische Suche oder das Verarbeiten großer Dokumentenmengen. In vielen Coding- und Agenten-Tests schlägt es sogar das größere 3 Flash, etwa bei SWE-Bench Pro (54,2 statt 49,6 Prozent). Google rollt das Modell zusätzlich in der Google-Suche aus.
Gemini 3.5 Flash Cyber: Spezialist für Sicherheitslücken
Das dritte Modell ist ein Sonderfall. Gemini 3.5 Flash Cyber basiert auf 3.5 Flash und wurde darauf trainiert, Sicherheitslücken in Code zu finden, zu prüfen und zu schließen. Es arbeitet innerhalb des Agenten CodeMender und erreicht im Benchmark CyberGym eine Leistung auf Spitzenniveau. Wegen des Missbrauchspotenzials bleibt der Zugang aber vorerst auf Behörden und geprüfte Partner in einem Pilotprogramm beschränkt.
Preise und Verfügbarkeit im Überblick
| Modell | Input (pro 1 Mio. Token) | Output (pro 1 Mio. Token) | Besonderheit |
|---|---|---|---|
| Gemini 3.6 Flash | 1,50 $ | 7,50 $ | Neues Standardmodell, 17 % effizienter |
| Gemini 3.5 Flash-Lite | 0,30 $ | 2,50 $ | Schnellstes 3.5-Modell, 350 Token/s |
| Gemini 3.5 Flash Cyber | k. A. | k. A. | Nur für Behörden und Partner (Pilot) |
3.6 Flash und 3.5 Flash-Lite sind ab sofort verfügbar: für Entwickler über die Gemini-API in Google AI Studio, für Unternehmen über Gemini Enterprise und für alle anderen in der Gemini-App. Wer sich für Googles KI-Ökosystem interessiert, findet auch bei Gemini Notebook spannende Neuerungen.
Fazit
Mit Gemini 3.6 Flash, 3.5 Flash-Lite und Flash Cyber schärft Google seine günstige Flash-Reihe genau dort, wo aktuell der Preiskampf tobt: bei skalierbaren KI-Agenten. Statt eines neuen Spitzenmodells gibt es diesmal mehr Tempo und weniger Kosten pro Aufgabe. Das noch fehlende 3.5 Pro und das bereits gestartete Training von Gemini 4 deuten an, dass der nächste große Schritt nicht mehr lange auf sich warten lässt.
Quelle: Google (The Keyword)

