2026-07-21 发布

Gemini 3.6 Flash 指南

Google Flash 主力更新:编码与多模态更强,Paid 档 $1.50 输入 / $7.50 输出(每百万 token,输出含 thinking tokens)。

#gemini-3.6-flash #$1.50 / $7.50 #1,048,576 context #July 21, 2026
发布状态

Gemini 3.6 Flash 已以 gemini-3.6-flash 提供。同日还有 3.5 Flash-Lite 与 3.5 Flash Cyber,规格勿与 3.6 Flash 混写。

一览

模型 id
gemini-3.6-flash
API 价格(Paid)
输入 $1.50 / 输出 $7.50(每百万 token)
上下文
输入 1,048,576 / 输出 65,536
知识截止
2026-03(厂商模型卡)

对构建者标明的能力

据 Google 模型文档:缓存、代码执行、function calling、thinking、computer use(预览)等。

支持缓存
支持代码执行
支持 function calling
支持 thinking
Computer use(预览)
多模态输入(文本/图像/视频/音频/PDF),文本输出

效率说明(带来源)

Google 称在 Artificial Analysis Index 上比 3.5 Flash 约少 17% 输出 token。这是厂商引用的效率说法,不是全面编码能力排名。

成本三角(只谈价格)

短上下文标价对照,便于路由讨论。能力强弱不在此断言。

GPT-5.6 Luna

2026-07-30 降价后 $0.20 / $1.20。本组里常见的海量执行低价档。

Gemini 3.6 Flash

Paid 档 $1.50 / $7.50(输出含 thinking tokens)。

Claude Sonnet 5(介绍价)

至 2026-08-31 为 $2 / $10,之后 $3 / $15。许多 Claude Code 用户的 agentic 默认档。

来源

Google 博文 Introducing Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber(2026-07-21);ai.google.dev 模型与定价页。

常见问题

Gemini 3.6 Flash API 价格是多少?

Gemini Developer API Paid 档列出每百万 token 输入 $1.50、输出 $7.50,输出包含 thinking tokens。

3.6 Flash 和 3.5 Flash-Lite 是同一模型吗?

不是。3.6 Flash 是主力 workhorse;3.5 Flash-Lite 与 3.5 Flash Cyber 是同日发布的不同模型。

gemini-3.6-flash 上下文多大?

文档为输入 1,048,576、输出 65,536 token。

能在 QCode 用 Gemini 吗?

QCode 提供多模型接入,模型页启用的 Gemini 系列可选。创建账号后按客户端支持的 model id 选择即可。

创建 QCode 账号

套餐自 ¥60 / $8.57 起。一把 key 覆盖 Claude、GPT 与 Gemini 等模型。