Gemini 3.5 Flash-Lite
Standard $0.30 / $2.50
Stand 2026-08-30 nennt die offizielle Preistabelle Standard $0.30 Input / $2.50 Output pro Million Tokens (Output inklusive Thinking). Stabile ID gemini-3.5-flash-lite, 1,048,576 Input, 65,536 Output. Diese Seite behauptet nicht, dass die ID auf QCode live ist.
Aktualisiert 2026-08-30
Kernpunkte
Standardpreis / 1M Tokens
Offiziell Standard: $0.30 Input (Text/Bild/Video/Audio), $2.50 Output inklusive Thinking. Gegenüber 3.5 Flash mit $1.50 / $9.00 ist der Input etwa 5× günstiger.
Input-Limit
Input token limit laut offizieller Modelltabelle, identisch mit 3.5 Flash.
Output-Limit
Output token limit laut offizieller Modelltabelle. Einige Übersichtsseiten runden auf 64,000; diese Seite verwendet 65,536 aus der Modelltabelle.
Letzte Aktualisierung der Modellseite
Latest update der offiziellen Modellseite: Juli 2026. Versionen: Stable gemini-3.5-flash-lite.
Was 3.5 Flash-Lite ist
Google beschreibt ein latenzarmes, kosteneffizientes multimodales Flash-Modell für Sub-Agents mit hohem Durchsatz, Dokumentenanalyse und einfache Extraktion. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle ähnelt 3.5 Flash: Caching, Code Execution, Function Calling, Search Grounding, Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung, keine Live API.
Wonach weiterhin gesucht wird
Lite-Suchanfragen sind Abrechnungsfragen, keine Launch-News. 3.5 Flash Standard kostet $1.50 / $9.00; Lite kostet $0.30 / $2.50. Verwechseln Sie die ID nicht mit gemini-3.1-flash-lite – das ist eine andere, günstigere Flash-Lite-Linie ($0.25 Text-/Bild-/Video-Input). Diese Seite behandelt nur 3.5 Flash-Lite.
Zeitachse
Latest update der Modellseite: Juli 2026. Stabile ID gemini-3.5-flash-lite.
Am 2026-08-30 weiterhin gelistet: Standard $0.30 / $2.50. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50.
Dieser Abruf der Modellseite und der Preistabelle. Die Einführungspreise von 3.6 / 3.7 gehören zu einer anderen Flash-SKU – übertragen Sie sie nicht auf Lite.
Bestätigt vs. Stolperfallen
Bestätigt
Stabile ID gemini-3.5-flash-lite; 1,048,576 / 65,536; Standard $0.30 / $2.50. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.
Stolperfallen
Schreiben Sie 3.5 Flash-Lite nicht als 3.1 Flash-Lite. Bei den Fenstergrößen gilt die Modelltabelle mit 65,536, nicht Übersichtsseiten, die 64,000 angeben. Diese Seite sagt nicht, dass es auf QCode bereits verfügbar ist oder dass Sie auf demselben Endpunkt umschalten können.
Lite vs. 3.5 Flash
3.5 Flash-Lite (diese Seite)
Hoher Durchsatz, niedrigerer Preis, Sub-Agents oder Extraktion. Kalkulieren Sie mit $0.30 / $2.50.
3.5 Flash
Wenn Sie mehr Reasoning-Tiefe benötigen, nutzen Sie gemini-3.5-flash zum Standardpreis von $1.50 / $9.00. Der Input kostet etwa das 5-Fache des Lite-Tarifs.
So rufen Sie es auf
Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash-lite. Die Fähigkeiten entnehmen Sie der Modellseite. Behandeln Sie Computer Use als Preview. Tauschen Sie die 3.1-ID nicht einfach aus.
Auf QCode
Diese Seite behauptet nicht, dass gemini-3.5-flash-lite auf QCode bereits aufrufbar ist, und sagt auch nicht, dass Sie auf demselben Endpunkt umschalten können. Ob die ID im aktuellen Katalog erscheint, zeigen /models und Ihr eigener Test. Für Googles eigenen Weg nutzen Sie die Gemini API.
FAQ
Wie lautet die Modell-ID?
gemini-3.5-flash-lite. Die offizielle Modellseite kennzeichnet sie als Stable.
Was berechnet Google aktuell?
Standard: $0.30 Input / $2.50 Output pro Million Tokens, Output inklusive Thinking. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50. Abgerufen am 2026-08-30.
Wie viel günstiger als 3.5 Flash?
3.5 Flash Standard kostet $1.50 / $9.00. Lite-Input kostet etwa ein Fünftel; Output $2.50 statt $9.00.
Sind es 64k oder 65,536 Fenstergröße?
Die Modelltabelle nennt Output token limit 65,536. Einige Übersichtsseiten sagen 64,000. Diese Seite folgt der Modelltabelle.
Kann es Bilder oder Audio generieren?
Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt.
Kann ich es über QCode aufrufen?
Diese Seite gibt kein Verfügbarkeitsversprechen. Nutzen Sie die aktuelle /models-Liste und testen Sie selbst. Verstehen Sie einen Katalog-Schnappschuss nicht als „bereits verfügbar“.
Quellen
ai.google.dev-Modellseite /gemini-api/docs/models/gemini-3.5-flash-lite (Last updated 2026-07-30 UTC); Preise unter /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash-Lite. Die Preise für 3.5 Flash stammen von derselben Preisseite. Abgerufen am 2026-08-30.
Zuerst den offiziellen Preis von Lite lesen
Die Spezifikationen von 3.5 Flash-Lite folgen der Dokumentation von Google. Der Katalog von QCode ist die aktuelle /models-Liste.
Verwandt
Gemini 3.5 Flash Leitfaden
Das Flash-Modell ohne Lite aus derselben Generation, $1.50 / $9.00.
Gemini 3.6 Flash Leitfaden
Eine neuere Flash-SKU.
Gemini 3.7 Flash Preise
So lesen Sie Einführungspreise.
Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. Diese Seite ist kein Versprechen, dass QCode diese ID aufrufen kann.