Modellspezifikation · 2026-08-30

Gemini 3.5 Flash
Stabile ID gemini-3.5-flash

Stand 2026-08-30 führt die offizielle Modellseite weiterhin die stabile ID gemini-3.5-flash: 1,048,576 Input, 65,536 Output, Standard $1.50 / $9.00 pro Million Tokens (der Output umfasst das Thinking). Die Standardstufe für Thinking ist medium. Diese Seite behauptet nicht, dass die ID bei QCode verfügbar ist.

Aktualisiert 2026-08-30

#gemini-3.5-flash#$1.50 / $9.00#1,048,576#medium

Das Wichtigste

$1.50 / $9.00

Standardpreis / 1M Tokens

Offizielle Preise, Standard: $1.50 Input, $9.00 Output einschließlich Thinking-Tokens. Batch / Flex kosten $0.75 / $4.50. Das ist nicht der Einführungspreis von 3.6 / 3.7.

1,048,576

Input-Limit

Offizielle Modelltabelle, Input token limit. What's new nennt zudem ein Kontextfenster von 1M.

65,536

Output-Limit

Offizielle Modelltabelle, Output token limit. What's new rundet auf 65k. Diese Seite verwendet 65,536 aus der Modelltabelle.

medium

Standard-Thinking

What's new in Gemini 3.5 Flash: Der Standard wurde von high bei 3 Flash Preview auf medium gesetzt. Optionen: minimal / low / medium / high. Senden Sie thinking_budget nicht in derselben Anfrage mit.

Was 3.5 Flash ist

Ein stabiles Flash-SKU der Gemini API. Offizielle Positionierung: dauerhaft Spitzenleistung für Agenten und Coding. Eingaben: Text, Bild, Video, Audio, PDF. Ausgabe: Text. Die Fähigkeitentabelle umfasst Caching, Codeausführung, Function Calling, Search Grounding, strukturierte Ausgaben, URL-Kontext und Thinking. Computer Use ist Preview. Keine Audiogenerierung, keine Bildgenerierung und keine Live API.

Wonach weiterhin gesucht wird

3.6 / 3.7 Flash sind bereits GA, mit Einführungspreis $0.75 / $3.75 bis 2026-12-31. Die Suchen nach 3.5 Flash lauten inzwischen „Ist meine alte ID noch die günstige?“ Der offizielle Standardpreis beträgt weiterhin $1.50 / $9.00 – nicht günstiger als der Einführungspreis von 3.6 / 3.7. Am 2026-08-30 wird 3.5 Flash weiterhin für das Schreiben genannt.

Zeitleiste

2026-05

Modellseite, Latest update: May 2026. Stabile ID gemini-3.5-flash; der Preview-Alias gemini-3-flash-preview ist weiterhin aufgeführt.

Wissensstand

What's new FAQ: Wissensstand Januar 2025. Nutzen Sie Search Grounding für neuere Fakten.

2026-08-30

Dieser Abruf: Modellseite, Preistabelle und What's new (Fußzeile 2026-08-26) stimmen weiterhin mit diesen Angaben überein. Der Einführungspreis von 3.6 / 3.7 gilt bis 2026-12-31.

Bestätigt vs. Stolperfallen

Bestätigt

Stabile ID gemini-3.5-flash; 1,048,576 / 65,536; Standard $1.50 / $9.00; Standard-Thinking medium; Computer Use Preview. Quellen: offizielle Modellseite und Preise, abgerufen am 2026-08-30.

Stolperfallen

Verstehen Sie 3.5 Flash nicht als das günstigere Flash: Der Einführungspreis von 3.6 / 3.7 liegt bei $0.75 Input / $3.75 Output bis 2026-12-31. Ein Eintrag unter /models ist kein Versprechen, dass das Modell aufrufbar ist. Diese Seite sagt weder, dass es bereits bei QCode verfügbar ist, noch dass Sie auf demselben Endpunkt umschalten können.

3.5 vs. neuere Flash-Versionen

Bei 3.5 Flash bleiben

Ihr Workflow ist auf gemini-3.5-flash festgelegt, oder Sie gleichen alte Evals und Prompts ab. Kalkulieren Sie mit $1.50 / $9.00.

3.6 / 3.7 Flash ansehen

Sie möchten den Einführungspreis oder das aktuelle Arbeitspferd-Flash von Google. Der Einführungspreis von 3.7 beträgt $0.75 / $3.75 bis 2026-12-31, danach $1.50 / $7.50. Maßgeblich ist die Preistabelle von Google.

So rufen Sie es auf

Setzen Sie bei Gemini API / AI Studio / Vertex model=gemini-3.5-flash. Verwenden Sie thinking_level (Standard medium). Senden Sie thinking_budget nicht in derselben Anfrage mit. Die offizielle Dokumentation empfiehlt, temperature / top_p / top_k auf den Standardwerten zu belassen. Behandeln Sie Computer Use als Preview.

Bei QCode

Diese Seite behauptet nicht, dass gemini-3.5-flash bei QCode bereits aufrufbar ist, und sagt auch nicht, dass Sie auf demselben Endpunkt umschalten können. Ob die ID im Live-Katalog erscheint, zeigen /models und Ihr eigener Test. Für Googles eigenen Weg nutzen Sie die Gemini API.

FAQ

Wie lautet die Modell-ID?

gemini-3.5-flash. Die offizielle Modellseite kennzeichnet sie als Stable. Der Preview-Alias gemini-3-flash-preview ist weiterhin aufgeführt.

Was berechnet Google derzeit?

Standard: $1.50 Input / $9.00 Output pro Million Tokens, Output einschließlich Thinking. Batch / Flex $0.75 / $4.50. Priority $2.70 / $16.20. Preisseite abgerufen am 2026-08-30.

Wie lautet die Standardstufe für Thinking?

medium, geändert von high bei Gemini 3 Flash Preview. Optionen: minimal, low, medium, high. Nicht mit thinking_budget kombinieren.

Wie lautet der Knowledge Cutoff?

Offizielle FAQ: Januar 2025. Für neuere Fakten nutzen Sie Search Grounding.

Kann es Bilder oder Audio generieren?

Nein. Als Eingabe sind Bild, Video, Audio und PDF möglich; die Ausgabe ist Text. Bildgenerierung, Audiogenerierung und die Live API werden nicht unterstützt. Computer Use bleibt in der Preview.

Kann ich es über QCode aufrufen?

Diese Seite gibt kein Verfügbarkeitsversprechen. Nutzen Sie die aktuelle /models-Liste und testen Sie selbst. Verstehen Sie einen Katalog-Schnappschuss nicht als „bereits verfügbar“.

Quellen

ai.google.dev Modellseite /gemini-api/docs/models/gemini-3.5-flash (Last updated 2026-07-21 UTC); What's new /gemini-api/docs/whats-new-gemini-3.5 (Last updated 2026-08-26 UTC); Preise /gemini-api/docs/pricing, Abschnitt Gemini 3.5 Flash. Abgerufen am 2026-08-30.

Lesen Sie zuerst die offizielle ID und den Preis

Die Spezifikationen von 3.5 Flash folgen der Google-Dokumentation. Der QCode-Katalog ist die aktuelle /models-Liste.

Verwandt

Nicht mit Google / DeepMind verbunden. Preise und Kontextfenster folgen ai.google.dev. Diese Seite ist kein Versprechen, dass QCode diese ID aufrufen kann.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.