KI-Wirtschaft

Google startet Gemini 3.6 Flash und günstigeres Flash-Lite

3 Min. Lesezeit
Serverreihen in einem Google-Rechenzentrum mit einem Monitor, der das Gemini-Logo und eine Preistabelle zeigt, Symbolbild für den Start von Gemini 3.6 Flash und 3.5 Flash-Lite Generiertes Bild mit GPT Image 2
Serverreihen in einem Google-Rechenzentrum mit einem Monitor, der das Gemini-Logo und eine Preistabelle zeigt, Symbolbild für den Start von Gemini 3.6 Flash und 3.5 Flash-Lite

TL;DR Too Long; Didn’t read

Google hat am 21. Juli 2026 zwei neue KI-Modelle veröffentlicht: Gemini 3.6 Flash und Gemini 3.5 Flash-Lite. Der Ausgabepreis von Flash sinkt von neun auf 7,50 Dollar je Million Token, Flash-Lite startet bei 30 Cent. Eine unabhängige Analyse beziffert die realen Kosten pro Aufgabe wegen zusätzlicher Effizienzgewinne auf bis zu 31 Prozent weniger.

Das Wichtigste in Kürze

  • Gemini 3.6 Flash kostet in der Ausgabe 7,50 statt vorher neun Dollar je Million Token.
  • Flash-Lite richtet sich an Massenanwendungen und verarbeitet laut Google 350 Token pro Sekunde.
  • Der Wissensstand von Flash wandert auf März 2026 vor, bisher lag die Grenze bei Januar 2025.
  • Das Flaggschiff Gemini 3.5 Pro bleibt weiter in der Testphase bei ausgewählten Partnern.
  • Google hat das Training des nächsten Modells Gemini 4 nach eigenen Angaben begonnen.
  • Beide neuen Modelle laufen in der Gemini-App, in AI Studio und über die Gemini-API.

Google hat am 21. Juli 2026 zwei neue KI-Modelle vorgestellt: Gemini 3.6 Flash und Gemini 3.5 Flash-Lite lösen die bisherigen Flash-Varianten ab. Der Ausgabepreis von Flash sinkt von neun auf 7,50 Dollar je Million Token, während Flash-Lite bereits ab 30 Cent startet. Beide Modelle sollen laut Google zugleich weniger Rechenschritte für dieselbe Aufgabe benötigen.

Flash wird für Programmieraufgaben schneller und günstiger

Gemini 3.6 Flash ersetzt das bisherige Flash-Modell als Google DeepMinds schnelle Allround-KI für Programmieraufgaben, Recherche und Bildverarbeitung. Wie Google in seinem Blogbeitrag ankündigt, sinkt der Preis für ausgegebene Token von neun auf 7,50 Dollar je Million, während der Eingabepreis bei 1,50 Dollar bleibt. Nach Angaben des Marktforschers Artificial Analysis Index benötigt das Modell für gleichwertige Aufgaben zugleich 17 Prozent weniger Ausgabe-Token als der Vorgänger - Preissenkung und Effizienzgewinn addieren sich damit zu einer größeren Kostenersparnis.

Bei Programmieraufgaben zeigt sich der Fortschritt im Benchmark DeepSWE, der Software-Engineering-Aufgaben aus echten GitHub-Projekten misst: Der Wert steigt von 37 auf 49 Prozent gelöster Aufgaben. Im Benchmark OSWorld-Verified, der die eigenständige Bedienung von Desktop-Programmen prüft, erreicht Flash 83 statt zuvor 78,4 Prozent. Der Wissensstand des Modells wandert von Januar 2025 auf März 2026 vor. Entwicklerinnen und Entwickler erreichen Gemini 3.6 Flash über Google AI Studio, die Programmierumgebung Google Antigravity und die Gemini Enterprise Agent Platform, Privatnutzer über die Gemini-App.

Flash-Lite bedient Aufgaben mit hohem Datenvolumen

Gemini 3.5 Flash-Lite richtet sich an Aufgaben, bei denen große Textmengen schnell und günstig verarbeitet werden müssen, etwa automatisierte Dokumentenauswertung oder Suchagenten. Das Modell kostet 30 Cent je Million Eingabe-Token und 2,50 Dollar je Million Ausgabe-Token. Nach Angaben des Artificial Analysis Index liefert Flash-Lite bis zu 350 Token pro Sekunde aus - genug, um eine DIN-A4-Seite Text in rund eineinhalb Sekunden zu erzeugen.

Im Benchmark Terminal-Bench 2.1, der Kommandozeilen-Aufgaben von KI-Agenten prüft, steigt die Erfolgsquote gegenüber dem März-Vorgänger 3.1 Flash-Lite von 31 auf 54 Prozent. Beim Programmier-Benchmark SWE-Bench Pro erreicht Flash-Lite 54,2 Prozent und liegt damit vor dem größeren regulären Flash-Modell mit 49,6 Prozent - ungewöhnlich für eine schlanke Modellvariante. Neben den bekannten Zugangswegen über AI Studio und die Gemini-API rollt Google das Modell nach eigenen Angaben zusätzlich in der Google-Suche aus. Für Nutzerinnen und Nutzer in Deutschland und der übrigen EU sind beide neuen Modelle regulär zugänglich, anders als bei der parallel vorgestellten Sicherheitsvariante Flash Cyber, die vorerst nur Regierungen offensteht.

Flaggschiff Gemini 3.5 Pro bleibt aus, Training für Gemini 4 beginnt

Auffällig blieb bei der Vorstellung, was fehlte: Googles für das zweite Quartal 2026 angekündigtes Flaggschiff Gemini 3.5 Pro verzögert sich weiterhin und läuft laut Unternehmensangaben derzeit nur in Tests mit ausgewählten Partnern. Einen neuen Starttermin nennt Google nicht. Stattdessen kündigte der Konzern an, das Training des nächsten großen Modells Gemini 4 begonnen zu haben - nach eigener Beschreibung die „ambitionierteste Trainingsrun” bislang.

Die neue Flash-Generation reiht sich in einen Preiswettbewerb zwischen den großen KI-Anbietern ein: Erst Anfang Juli hatte OpenAI mit GPT-5.6 drei neue Preisstufen vorgestellt, deren günstigste Variante Luna bei einem Dollar je Million Eingabe-Token liegt. Google ergänzt Flash 3.6 zudem um verschärfte Sicherheitsvorkehrungen gegen den Missbrauch für chemische, biologische oder nukleare Zwecke sowie für Cyberangriffe, wie aus dem Modellbericht hervorgeht.

Entscheidend wird, ob Google die Effizienzgewinne auch beim ausstehenden Flaggschiff Gemini 3.5 Pro nachweisen kann, dessen wiederholte Verzögerung zunehmend nach einem strukturellen Problem bei den internen Programmier-Benchmarks aussieht. Bis ein neuer Termin feststeht, bleibt die schlankere Flash-Reihe der einzige sichtbare Fortschritt in Googles aktueller Modell-Roadmap.

Häufige Fragen

Was kostet Gemini 3.6 Flash über die API?

Die Nutzung kostet 1,50 Dollar je Million Eingabe-Token und 7,50 Dollar je Million Ausgabe-Token, abgerechnet über Google AI Studio oder die Gemini-API.

Wo ist Gemini 3.5 Flash-Lite verfügbar?

Entwicklerinnen und Entwickler erreichen es über AI Studio, Android Studio und die Gemini-API, Privatnutzer über die Gemini-App; die Google-Suche folgt laut Unternehmen in den kommenden Wochen.

Können Nutzerinnen und Nutzer in Deutschland die neuen Modelle bereits verwenden?

Ja, beide Modelle sind regulär in Deutschland und der übrigen EU zugänglich, anders als die zeitgleich vorgestellte Sicherheitsvariante Flash Cyber, die vorerst nur ausgewählten Regierungen offensteht.

Wann erscheint Gemini 3.5 Pro?

Google nennt weiterhin keinen Termin; das Flaggschiff befindet sich laut Unternehmen in Tests mit Partnern, nachdem interne Programmier-Ergebnisse hinter dem Zielwert zurückblieben.

Was ist über Gemini 4 bekannt?

Google hat lediglich bestätigt, das Training begonnen zu haben, und bezeichnet es als bislang „ambitionierteste Trainingsrun"; Details zu Fähigkeiten oder Termin nennt der Konzern nicht.


← Zurück zum Blog