Flash 0731 vs Sonnet 5
智力接近,成本差一个数量级(0731 为历史代际)
Sonnet 5 的 Artificial Analysis 智能指数略高(55 对 52);DeepSeek V4 Flash 赢在价格、速度和开放权重。两者都是 1M 上下文。
更新于 2026-09-19
要点
AA 智指
Sonnet 5 Adaptive Max vs Flash 0731(2026-07-31 版)Max。重叠区间,不是碾压。
AA 每任务成本
独立混合成本。Flash 缓存命中极便宜。
输出 tok/s
Flash 解码更快。Sonnet 在 max thinking 下 TTFT 可到约 191s——思考时间算进去了,不是坏了。
权重
Flash 0731 是 HF 上的 MIT 权重;2026-09-10 起这个 id 的请求由 deepseek-v4.1-flash 应答。Sonnet 5 闭源,Claude Code 默认。
这场对位
公司在问能不能用 Flash 换掉 Sonnet 5 省钱。老实话:高通量、规格清楚的编码/agent 环,常常可以;要的是 Claude 自己那套工具的贴合度和企业 Claude 栈,留 Sonnet。
圈子在吵
社区讨论里 Sonnet 5 常被形容为「吃 token」,而 Flash 的缓存命中几乎不计成本——这与 Artificial Analysis 测得的每任务成本差距($0.06 对 $1.54)方向一致。在 OpenCode 公布的用量图里,Flash 也常居 Go 流量首位。
关键日期
Sonnet 5 发布,导入价 $2/$10;2026-08-10 确认为标准价,原定 2026-09-01 的 $3/$15 上调已取消。
2026-07-31 Flash 0731 公测(该版本 2026-09-10 退役)。
2026-08-16 DeepSeek 峰谷价。仍远低于 Sonnet。
老实读表
用这些数
AA 对比页:52 vs 55,$0.06 vs $1.54,115 vs 69,TTFT 1.43s vs 191.38s,都是 1M。
这些数据不支持的结论
Flash「各项都和 Sonnet 5 并列」。DeepSWE 轶事 ≠ AA 指数。DeepSeek 官方表对的是 Opus-4.8 / GLM-5.2,不是 Sonnet 5。
什么时候选谁
选 Flash 0731(历史代际)
放量、本地/开源、OpenCode Go、预算 agent 环。
选 Sonnet 5
Claude Code 默认、Bedrock/企业、指令忠诚、自适应思考产品化。
两边怎么用
都是 1M 窗口。分词器和思考账单不同。Sonnet 现价 $2/$10(2026-08-10 起为标准价);原定 2026-09-01 起的 $3/$15 不会生效。
在 QCode 上
QCode 的 /models 目录当前列的是 deepseek-v4.1-flash 与 claude-sonnet-5,今天要对比就用这两个 id。旧名 deepseek-v4-flash 官方已于 2026-09-10 退役,0731 那一版的数字属历史代际。同一把 key 可直接调用两者;可调用的型号以该页实时列表为准。
常见问题
谁更聪明?
Sonnet 5,略高,AA 55 vs 52。
谁更便宜?
Flash,大幅度,即使 8-16 峰值之后。
为什么 Sonnet TTFT 191 秒?
包含了 max 自适应思考时间。不是卡死。
Flash 能替代 Claude Code 吗?
它可以当别的 harness(OpenCode、dsh)里的模型。它不是 Claude Code 产品。
9 月 1 日 Sonnet 会涨到 $3/$15 吗?
不会。$2/$10 已于 2026-08-10 确认为标准价,原定 2026-09-01 上调到 $3/$15 已取消。
上下文一样吗?
都宣传 1M。输出上限不同(Flash 384K vs Sonnet 128K,batches 300K beta)。
来源
AA Flash vs Sonnet 5;DeepSeek 定价;Anthropic Sonnet 5 intro 窗口。
相关
与 DeepSeek、Anthropic 无隶属。