Flash 0731 vs Sonnet 5
智力接近,成本差一个数量级
Sonnet 5 的 Artificial Analysis 智能指数略高(55 对 52);DeepSeek V4 Flash 赢在价格、速度和开放权重。两者都是 1M 上下文。
要点
AA 智指
Sonnet 5 Adaptive Max vs Flash 0731 Max。重叠区间,不是碾压。
AA 每任务成本
独立混合成本。Flash 缓存命中极便宜。
输出 tok/s
Flash 解码更快。Sonnet 在 max thinking 下 TTFT 可到约 191s——思考时间算进去了,不是坏了。
权重
Flash 0731 是 HF 上 MIT。Sonnet 5 闭源,Claude Code 默认。
这场对位
公司在问能不能用 Flash 换掉 Sonnet 5 省钱。老实话:高通量、规格清楚的编码/agent 环,常常可以;要 Claude 原生工具忠诚度和企业 Claude 栈,留 Sonnet。
圈子在吵
社区讨论里 Sonnet 5 常被形容为「吃 token」,而 Flash 的缓存命中几乎不计成本——这与 Artificial Analysis 测得的每任务成本差距($0.06 对 $1.54)方向一致。在 OpenCode 公布的用量图里,Flash 也常居 Go 流量首位。
关键日期
Sonnet 5 发布。intro $2/$10 至 8-31,之后 $3/$15。
Flash 0731 公测。
DeepSeek 峰谷价。仍远低于 Sonnet。
老实读表
用这些数
AA 对比页:52 vs 55,$0.06 vs $1.54,115 vs 69,TTFT 1.43s vs 191.38s,都是 1M。
这些数据不支持的结论
Flash「各项都和 Sonnet 5 并列」。DeepSWE 轶事 ≠ AA 指数。DeepSeek 官方表对的是 Opus-4.8 / GLM-5.2,不是 Sonnet 5。
什么时候选谁
选 Flash 0731
放量、本地/开源、OpenCode Go、预算 agent 环。
选 Sonnet 5
Claude Code 默认、Bedrock/企业、指令忠诚、自适应思考产品化。
两边怎么用
都是 1M 窗口。分词器和思考账单不同。Sonnet intro 价 2026-09-01 结束。
在 QCode 上
QCode 的 /models 目录当前同时列有 deepseek-v4-flash 与 claude-sonnet-5,可以用同一把 key 直接对比两者。可调用的型号以该页实时列表为准。
常见问题
谁更聪明?
Sonnet 5,略高,AA 55 vs 52。
谁更便宜?
Flash,大幅度,即使 8-16 峰值之后。
为什么 Sonnet TTFT 191 秒?
包含了 max 自适应思考时间。不是卡死。
Flash 能替代 Claude Code 吗?
它可以当别的 harness(OpenCode、dsh)里的模型。它不是 Claude Code 产品。
9 月 1 日后 Sonnet 多少钱?
标准每百万 $3 输入 / $15 输出。
上下文一样吗?
都宣传 1M。输出上限不同(Flash 384K vs Sonnet 128K,batches 300K beta)。
来源
AA Flash vs Sonnet 5;DeepSeek 定价;Anthropic Sonnet 5 intro 窗口。
相关
与 DeepSeek、Anthropic 无隶属。