Gemini 3.6 Flash Guide
Das Update des Flash-Arbeitspferds von Google: stärkere Coding- und Multimodal-Leistung bei $1.50 Input / $7.50 Output pro 1 Mio. Tokens (Paid-Tarif, Thinking-Tokens sind im Output enthalten).
Gemini 3.6 Flash ist allgemein verfügbar unter der Modell-ID gemini-3.6-flash. Mit derselben Ankündigung vom 21. Juli erschienen außerdem 3.5 Flash-Lite und 3.5 Flash Cyber als eigenständige Modelle – vermischen Sie deren Specs nicht mit denen von 3.6 Flash.
Auf einen Blick
Für Entwickler hervorgehobene Funktionen
Laut Google-Modelldokumentation: Caching, Code-Ausführung, Function Calling, Thinking, Computer Use (Preview) und zugehöriges Agent-Tooling.
Hinweis zur Effizienz (mit Quelle)
Google gibt an, dass das Modell im Artificial Analysis Index etwa 17 % weniger Output-Tokens als 3.5 Flash erzeugt. Das ist eine vom Anbieter genannte Effizienzangabe, kein vollständiges Qualitätsranking über alle Coding-Aufgaben hinweg.
Kostendreieck (nur Preise)
Listenpreise bei kurzem Kontext als Orientierung für das Routing. Die Modelle haben unterschiedliche Stärken – dieser Abschnitt vergleicht Dollarbeträge, keine Erfolgsquoten.
GPT-5.6 Luna
$0.20 / $1.20 pro 1 Mio. Tokens nach der Senkung vom 30.07.2026. Oft die günstigste Stufe für die Ausführung bei hohem Volumen in diesem Vergleich.
Gemini 3.6 Flash
$1.50 / $7.50 pro 1 Mio. Tokens (Paid-Tarif; der Output enthält Thinking-Tokens).
Claude Sonnet 5 (Einführungspreis)
$2 / $10 pro 1 Mio. Tokens, jetzt als regulärer Preis bestätigt. Für viele Claude-Code-Nutzer ein starker Standard für agentisches Coding.
Quellen
Google-Blog „Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber“ (21.07.2026); ai.google.dev models/gemini-3.6-flash sowie die Preisseiten.
FAQ
Was kostet die Gemini 3.6 Flash API?
Im Paid-Tarif der Gemini Developer API listet Google $1.50 pro Million Input-Tokens und $7.50 pro Million Output-Tokens, wobei der Output Thinking-Tokens enthält.
Ist Gemini 3.6 Flash dasselbe wie 3.5 Flash-Lite?
Nein. 3.6 Flash ist das Update des Arbeitspferds. 3.5 Flash-Lite und 3.5 Flash Cyber erschienen am selben Tag als eigenständige Modelle mit anderen Aufgaben.
Welches Kontextfenster hat gemini-3.6-flash?
Google dokumentiert für gemini-3.6-flash 1,048,576 Input-Tokens und 65,536 Output-Tokens.
Kann ich Gemini-Modelle über QCode nutzen?
Der /models-Katalog von QCode listet gemini-3.6-flash. Dieses Modell hatte zuletzt keine Aufrufe auf der Plattform – die Verfügbarkeit richtet sich nach der aktuellen /models-Liste und Ihren eigenen tatsächlichen Aufrufen; diese Seite gibt keine Verfügbarkeitsgarantie.
QCode-Konto erstellen
Pläne ab ¥60 / $8.57. Ein API-Key für Claude, GPT und Gemini.
Weiterführende Guides
Preis-Tracker für GPT-5.6 Luna
Luna $0.20/$1.20 nach der Senkung vom 30. Juli
Preise für Claude Sonnet 5
Der reguläre Preis von $2/$10 und die Cache-Stufen erklärt
KI-Modell-Radar 2026
Verfügbarkeits-Tracker inklusive Gemini 3.6 Flash
QCode ist nicht mit Google verbunden. Specs und Preise folgen der öffentlichen Google-Dokumentation in der für diese Seite geprüften Fassung.