模型规格 · 2026-08-30

Gemini 3.5 Flash-Lite
标准价 $0.30 / $2.50

截至 2026-08-30,官方定价表标准档输入 $0.30、输出 $2.50(每百万 token,输出含思考)。稳定 id gemini-3.5-flash-lite,输入 1,048,576、输出 65,536。本页不承诺该 id 在 QCode 上已可调用。

#gemini-3.5-flash-lite#$0.30 / $2.50#1,048,576#high-throughput

要点

$0.30 / $2.50

标准价 / 百万 token

官方定价表 Standard:输入 $0.30(文本/图/视频/音频),输出 $2.50(含思考)。相对 3.5 Flash 的 $1.50 / $9.00,输入约 5 倍价差。

1,048,576

输入上限

官方模型表 Input token limit,与 3.5 Flash 相同。

65,536

输出上限

官方模型表 Output token limit。有的概览页写成 64,000;本页用模型表的 65,536。

2026-07

模型页最近更新

官方模型页 Latest update:July 2026。Versions 写 Stable: gemini-3.5-flash-lite。

3.5 Flash-Lite 是什么

Google 把它写成低延迟、偏成本的多模态 Flash:高吞吐子代理、文档解析、简单抽取。输入文本、图像、视频、音频、PDF,输出文本。能力表与 3.5 Flash 类似:缓存、代码执行、函数调用、Search grounding、思考;Computer use 为 Preview。不支持音频生成、图像生成、Live API。

现在还在被搜什么

人搜 Lite 是因为账单,不是发布新闻。3.5 Flash 标准档 $1.50 / $9.00,Lite 是 $0.30 / $2.50。不要和 gemini-3.1-flash-lite 混 id:那是另一条更便宜的 Flash-Lite 线(文本/图/视频输入 $0.25)。本页只讲 3.5 Flash-Lite。

时间线

2026-07

官方模型页 Latest update:July 2026。稳定 id gemini-3.5-flash-lite。

定价表

2026-08-30 仍列 Standard $0.30 / $2.50。Batch / Flex $0.15 / $1.25。Priority $0.54 / $4.50。

2026-08-30

本轮抓取模型页与定价表。3.6 / 3.7 引入价是另一档 Flash,不要拿来当 Lite 的价。

已确认 vs 注意

已确认

稳定 id gemini-3.5-flash-lite;1,048,576 / 65,536;标准价 $0.30 / $2.50。来源:官方模型页与定价表,抓取 2026-08-30。

注意

不要把 3.5 Flash-Lite 写成 3.1 Flash-Lite。窗口数字以模型表 65,536 为准,不以概览页的 64,000 为准。本页不写 QCode 已可用或同一端点切换。

Lite 还是 3.5 Flash

3.5 Flash-Lite(本页)

高吞吐、低价、子代理或抽取。按 $0.30 / $2.50 算。

3.5 Flash

要更高推理深度时用 gemini-3.5-flash,标准档 $1.50 / $9.00。输入大约贵 5 倍。

怎么调用

官方 Gemini API / AI Studio / Vertex 上 model=gemini-3.5-flash-lite。能力与限制以模型页为准。Computer use 按 Preview。不要随手改成 3.1 的 id。

在 QCode 上

本页不承诺 gemini-3.5-flash-lite 在 QCode 上已可调用,也不写同一端点切换。是否出现在实时目录、能否实际调通,以 /models 和你的实测为准。要官方通道就用 Google 的 Gemini API。

常见问题

模型 id 是什么?

gemini-3.5-flash-lite。官方模型页标成 Stable。

现在官方多少钱?

标准档每百万 token 输入 $0.30、输出 $2.50(含思考)。Batch / Flex $0.15 / $1.25。Priority $0.54 / $4.50。抓取 2026-08-30。

和 3.5 Flash 差多少钱?

3.5 Flash 标准档 $1.50 / $9.00。Lite 输入约 1/5,输出 $2.50 vs $9.00。

窗口是 64k 还是 65,536?

模型表写 Output token limit 65,536。有的概览页写成 64,000。本页跟模型表。

能生成图或语音吗?

不能。输入可以是图、视频、音频和 PDF,输出是文本。图像生成、音频生成、Live API 均不支持。

QCode 上能调吗?

本页不做可用性承诺。以 /models 实时列表和你的实测为准。不要把目录快照读成「已可用」。

信息来源

ai.google.dev 模型页 /gemini-api/docs/models/gemini-3.5-flash-lite(Last updated 2026-07-30 UTC);定价表 /gemini-api/docs/pricing 的 Gemini 3.5 Flash-Lite 节。对照 3.5 Flash 价格同页。本轮 2026-08-30 抓取。

先看 Lite 的官方价,再决定从哪调

3.5 Flash-Lite 的规格以 Google 文档为准。QCode 目录以 /models 实时列表为准。

相关阅读

与 Google / DeepMind 无隶属。价格与窗口以 ai.google.dev 为准。本页不构成 QCode 已可调用该 id 的承诺。