模型对比 · 两大旗舰

Claude Fable 5 vs GPT-5.6 Sol:两大旗舰怎么选

两款模型都在最近两个月内成为各自阵营的旗舰,价格结构却完全不同——Fable 5 贵在输出,Sol 全面更便宜。这里给出规格对比、成本估算与选型建议。

#价格对比#SWE-Bench Pro#上下文窗口#选型建议
当前状态:两款都是现役旗舰

Claude Fable 5 于 2026-06-09 正式发布,GPT-5.6 Sol 随 GPT-5.6 家族于 2026-07-09 上线。截至本文更新(2026-08-08),两者都是各自厂商的旗舰档模型,均未被更新版本取代。

最近复核:2026-08-08。

规格与价格对比

价格与上下文窗口来自官方定价页与 LiteLLM 权威价格表;SWE-Bench Pro 分数口径请见下方说明,Sol 的对应分数官方未单独公布。

模型 输入价(每百万 token) 输出价(每百万 token) 上下文窗口 SWE-Bench Pro
Claude Fable 5 $10.00 $50.00 约 100 万 token 80.3%(官方评测口径,见下文说明)
GPT-5.6 Sol $5.00 $30.00 约 105 万 token 官方未单独公布

三个关键细节

跑分口径:80.3% 不是中立复现

Fable 5 在 SWE-Bench Pro 上的 80.3% 是用 Anthropic 自有评测框架(scaffolding)跑出的成绩,独立评测机构的复现结果与官方数字有出入。这不是说分数造假,而是评测方法本身会影响结果——完整的口径拆解见站内专文《SWE-Bench Pro:Fable 5 跑分到底怎么算的》,这里不重复展开。Sol 这边情况更简单:官方没有单独公布过它的 SWE-Bench Pro 分数,我们没有查到,就不填这一格。

价格结构完全不同

Fable 5 输出价是 Sol 的近 1.7 倍($50 vs $30 每百万 token),输入价是 Sol 的 2 倍($10 vs $5)。Sol 的定价在 2026-07-30 那轮 GPT-5.6 全系调价中原封未动(同批 Terra 降 20%、Luna 降 80%),说明 OpenAI 认为 Sol 的定价已经具备竞争力,没有跟进降价的压力。

上下文窗口接近,不构成决定性差异

Fable 5 约 100 万 token,Sol 约 105 万 token,两者在「超长上下文」这个维度上基本打平,不是选型的核心变量——真正拉开差距的是价格结构和你对 80.3% 这个分数的信任程度。

怎么选

按预算敏感度和任务复杂度给建议,不是「哪个更强」的单一结论。

预算敏感、任务量大:优先 Sol

输出价只有 Fable 5 的 60%,输入价只有一半。如果你的工作流是高频、大批量调用(比如 CI 里跑测试生成、批量代码审查),价格差会被调用量放大,Sol 的账单优势很明显。

追求跑分数字、预算不敏感:Fable 5

如果你更看重 SWE-Bench Pro 的绝对数字,且预算不是主要约束,Fable 5 的 80.3% 目前是该榜单上并列最高分(前提是接受官方评测口径这个前提,见上文说明)。

拿不准就先小流量对照

两个模型在 QCode 上用同一把 key 都能调用,与其纠结哪个「更强」,不如拿你自己的真实任务各跑一批小流量对照,再决定长期用哪个——不同代码库、不同任务类型的实际表现差异,比跑分数字更能说明问题。

时间线

两款模型近两个月内的关键节点。

2026-06-09

Claude Fable 5 正式发布

Anthropic 官方发布 Fable 5,定价输入 $10.00 / 输出 $50.00(每百万 token),上下文窗口约 100 万 token。

2026-07-09

GPT-5.6 家族上线,Sol 为旗舰档

OpenAI 发布 GPT-5.6 三档(Sol/Terra/Luna),Sol 为最高档,定价输入 $5.00 / 输出 $30.00(每百万 token),上下文窗口约 105 万 token。

2026-07-30

GPT-5.6 全系调价,Sol 价格未变

Terra 降价 20%、Luna 降价 80%,Sol 价格维持原样,是本轮调价中唯一没有变动的一档。

主要来源

Anthropic Fable 5 官方发布页;vellum.ai 关于 SWE-Bench Pro 跑分口径的拆解文章;LiteLLM model_prices_and_context_window.json(价格数据权威来源,2026-08-08 核对)。

常见问题

Sol 的 SWE-Bench Pro 分数是多少?

官方未单独公布 GPT-5.6 Sol 的 SWE-Bench Pro 分数,我们没有查到可靠的公开数据,因此本页不填这个数字,也不会用其他榜单的分数替代或估算。

Fable 5 的 80.3% 能直接拿来跟别的模型比吗?

要谨慎。这个分数是 Anthropic 自有评测框架(scaffolding)产出的,不是中立第三方复现的结果,独立评测机构给出的表现与之有出入。详细的口径拆解见站内专文《SWE-Bench Pro:Fable 5 跑分到底怎么算的》。

处理一个中等复杂度的 PR,两个模型大概要花多少钱?

这里只能给估算,不是实测数据:假设一个中等复杂度 PR 消耗约 15 万输入 token、2 万输出 token,Fable 5 约合 $1.5(输入)+ $1.0(输出)= 约 $2.5;Sol 约合 $0.75(输入)+ $0.6(输出)= 约 $1.35。实际消耗因代码库大小、上下文长度和任务复杂度差异很大,务必用自己的真实任务重新核算。

在 QCode 上能同时用这两个模型吗?

可以,Claude Fable 5 和 GPT-5.6 Sol 目前都在 QCode 的可调用模型列表中,同一把 key 即可切换使用,不需要分别开通。

创建 QCode 账号

套餐自 ¥60 / $8.57 起。一把 key 覆盖 Claude、GPT 与 Gemini 等模型。

相关指南

本站与 Anthropic、OpenAI 均无隶属关系。价格与跑分数据以官方及权威第三方源为准,本页信息截至 2026-08-08,可能变动;成本估算仅供参考,不代表实测数据。