Modellspezifikation · 2026-08-30

Gemini 3.5 Flash-Lite
Standard $0.30 / $2.50

Stand 2026-08-30 nennt die offizielle Preistabelle Standard $0.30 Input / $2.50 Output pro Million Tokens (Output inklusive Thinking). Stabile ID gemini-3.5-flash-lite, 1,048,576 Input, 65,536 Output. Diese Seite behauptet nicht, dass die ID auf QCode live ist.

Aktualisiert 2026-08-30

#gemini-3.5-flash-lite#$0.30 / $2.50#1,048,576#Hoher Durchsatz

Kernpunkte

$0.30 / $2.50

Standardpreis / 1M Tokens

Offiziell Standard: $0.30 Input (Text/Bild/Video/Audio), $2.50 Output inklusive Thinking. Gegenüber 3.5 Flash mit $1.50 / $9.00 ist der Input etwa 5× günstiger.

1,048,576

Input-Limit

Input token limit laut offizieller Modelltabelle, identisch mit 3.5 Flash.

65,536

Output-Limit

Output token limit laut offizieller Modelltabelle. Einige Übersichtsseiten runden auf 64,000; diese Seite verwendet 65,536 aus der Modelltabelle.

2026-07

Letzte Aktualisierung der Modellseite

Latest update der offiziellen Modellseite: Juli 2026. Versionen: Stable gemini-3.5-flash-lite.

Was 3.5 Flash-Lite ist

Google beschreibt ein latenzarmes, kosteneffizientes multimodales Flash-Modell für Sub-Agents mit hohem Durchsatz, Dokumentenanalyse und einfache Extraktion. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle ähnelt 3.5 Flash: Caching, Code Execution, Function Calling, Search Grounding, Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung, keine Live API.

Wonach weiterhin gesucht wird

Lite-Suchanfragen sind Abrechnungsfragen, keine Launch-News. 3.5 Flash Standard kostet $1.50 / $9.00; Lite kostet $0.30 / $2.50. Verwechseln Sie die ID nicht mit gemini-3.1-flash-lite – das ist eine andere, günstigere Flash-Lite-Linie ($0.25 Text-/Bild-/Video-Input). Diese Seite behandelt nur 3.5 Flash-Lite.

Zeitachse

2026-07

Latest update der Modellseite: Juli 2026. Stabile ID gemini-3.5-flash-lite.

Preistabelle

Am 2026-08-30 weiterhin gelistet: Standard $0.30 / $2.50. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50.

2026-08-30

Dieser Abruf der Modellseite und der Preistabelle. Die Einführungspreise von 3.6 / 3.7 gehören zu einer anderen Flash-SKU – übertragen Sie sie nicht auf Lite.

Bestätigt vs. Stolperfallen

Bestätigt

Stabile ID gemini-3.5-flash-lite; 1,048,576 / 65,536; Standard $0.30 / $2.50. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.

Stolperfallen

Schreiben Sie 3.5 Flash-Lite nicht als 3.1 Flash-Lite. Bei den Fenstergrößen gilt die Modelltabelle mit 65,536, nicht Übersichtsseiten, die 64,000 angeben. Diese Seite sagt nicht, dass es auf QCode bereits verfügbar ist oder dass Sie auf demselben Endpunkt umschalten können.

Lite vs. 3.5 Flash

3.5 Flash-Lite (diese Seite)

Hoher Durchsatz, niedrigerer Preis, Sub-Agents oder Extraktion. Kalkulieren Sie mit $0.30 / $2.50.

3.5 Flash

Wenn Sie mehr Reasoning-Tiefe benötigen, nutzen Sie gemini-3.5-flash zum Standardpreis von $1.50 / $9.00. Der Input kostet etwa das 5-Fache des Lite-Tarifs.

So rufen Sie es auf

Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash-lite. Die Fähigkeiten entnehmen Sie der Modellseite. Behandeln Sie Computer Use als Preview. Tauschen Sie die 3.1-ID nicht einfach aus.

Auf QCode

Diese Seite behauptet nicht, dass gemini-3.5-flash-lite auf QCode bereits aufrufbar ist, und sagt auch nicht, dass Sie auf demselben Endpunkt umschalten können. Ob die ID im aktuellen Katalog erscheint, zeigen /models und Ihr eigener Test. Für Googles eigenen Weg nutzen Sie die Gemini API.

FAQ

Wie lautet die Modell-ID?

gemini-3.5-flash-lite. Die offizielle Modellseite kennzeichnet sie als Stable.

Was berechnet Google aktuell?

Standard: $0.30 Input / $2.50 Output pro Million Tokens, Output inklusive Thinking. Batch / Flex $0.15 / $1.25. Priority $0.54 / $4.50. Abgerufen am 2026-08-30.

Wie viel günstiger als 3.5 Flash?

3.5 Flash Standard kostet $1.50 / $9.00. Lite-Input kostet etwa ein Fünftel; Output $2.50 statt $9.00.

Sind es 64k oder 65,536 Fenstergröße?

Die Modelltabelle nennt Output token limit 65,536. Einige Übersichtsseiten sagen 64,000. Diese Seite folgt der Modelltabelle.

Kann es Bilder oder Audio generieren?

Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt.

Kann ich es über QCode aufrufen?

Diese Seite gibt kein Verfügbarkeitsversprechen. Nutzen Sie die aktuelle /models-Liste und testen Sie selbst. Verstehen Sie einen Katalog-Schnappschuss nicht als „bereits verfügbar“.

Quellen

ai.google.dev-Modellseite /gemini-api/docs/models/gemini-3.5-flash-lite (Last updated 2026-07-30 UTC); Preise unter /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash-Lite. Die Preise für 3.5 Flash stammen von derselben Preisseite. Abgerufen am 2026-08-30.

Zuerst den offiziellen Preis von Lite lesen

Die Spezifikationen von 3.5 Flash-Lite folgen der Dokumentation von Google. Der Katalog von QCode ist die aktuelle /models-Liste.

Verwandt

Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. Diese Seite ist kein Versprechen, dass QCode diese ID aufrufen kann.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.