Claude Fable 5 vs GPT-5.6 Sol:两大旗舰怎么选
两款模型都在最近两个月内成为各自阵营的旗舰,价格结构却完全不同——Fable 5 贵在输出,Sol 全面更便宜。这里给出规格对比、成本估算与选型建议。
Claude Fable 5 于 2026-06-09 正式发布,GPT-5.6 Sol 随 GPT-5.6 家族于 2026-07-09 上线。截至本文更新(2026-08-08),两者都是各自厂商的旗舰档模型,均未被更新版本取代。
最近复核:2026-08-08。
规格与价格对比
价格与上下文窗口来自官方定价页与 LiteLLM 权威价格表;SWE-Bench Pro 分数口径请见下方说明,Sol 的对应分数官方未单独公布。
| 模型 | 输入价(每百万 token) | 输出价(每百万 token) | 上下文窗口 | SWE-Bench Pro |
|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | 约 100 万 token | 80.3%(官方评测口径,见下文说明) |
| GPT-5.6 Sol | $5.00 | $30.00 | 约 105 万 token | 官方未单独公布 |
三个关键细节
跑分口径:80.3% 不是中立复现
Fable 5 在 SWE-Bench Pro 上的 80.3% 是用 Anthropic 自有评测框架(scaffolding)跑出的成绩,独立评测机构的复现结果与官方数字有出入。这不是说分数造假,而是评测方法本身会影响结果——完整的口径拆解见站内专文《SWE-Bench Pro:Fable 5 跑分到底怎么算的》,这里不重复展开。Sol 这边情况更简单:官方没有单独公布过它的 SWE-Bench Pro 分数,我们没有查到,就不填这一格。
价格结构完全不同
Fable 5 输出价是 Sol 的近 1.7 倍($50 vs $30 每百万 token),输入价是 Sol 的 2 倍($10 vs $5)。Sol 的定价在 2026-07-30 那轮 GPT-5.6 全系调价中原封未动(同批 Terra 降 20%、Luna 降 80%),说明 OpenAI 认为 Sol 的定价已经具备竞争力,没有跟进降价的压力。
上下文窗口接近,不构成决定性差异
Fable 5 约 100 万 token,Sol 约 105 万 token,两者在「超长上下文」这个维度上基本打平,不是选型的核心变量——真正拉开差距的是价格结构和你对 80.3% 这个分数的信任程度。
怎么选
按预算敏感度和任务复杂度给建议,不是「哪个更强」的单一结论。
预算敏感、任务量大:优先 Sol
输出价只有 Fable 5 的 60%,输入价只有一半。如果你的工作流是高频、大批量调用(比如 CI 里跑测试生成、批量代码审查),价格差会被调用量放大,Sol 的账单优势很明显。
追求跑分数字、预算不敏感:Fable 5
如果你更看重 SWE-Bench Pro 的绝对数字,且预算不是主要约束,Fable 5 的 80.3% 目前是该榜单上并列最高分(前提是接受官方评测口径这个前提,见上文说明)。
拿不准就先小流量对照
两个模型在 QCode 上用同一把 key 都能调用,与其纠结哪个「更强」,不如拿你自己的真实任务各跑一批小流量对照,再决定长期用哪个——不同代码库、不同任务类型的实际表现差异,比跑分数字更能说明问题。
时间线
两款模型近两个月内的关键节点。
Claude Fable 5 正式发布
Anthropic 官方发布 Fable 5,定价输入 $10.00 / 输出 $50.00(每百万 token),上下文窗口约 100 万 token。
GPT-5.6 家族上线,Sol 为旗舰档
OpenAI 发布 GPT-5.6 三档(Sol/Terra/Luna),Sol 为最高档,定价输入 $5.00 / 输出 $30.00(每百万 token),上下文窗口约 105 万 token。
GPT-5.6 全系调价,Sol 价格未变
Terra 降价 20%、Luna 降价 80%,Sol 价格维持原样,是本轮调价中唯一没有变动的一档。
主要来源
Anthropic Fable 5 官方发布页;vellum.ai 关于 SWE-Bench Pro 跑分口径的拆解文章;LiteLLM model_prices_and_context_window.json(价格数据权威来源,2026-08-08 核对)。
常见问题
Sol 的 SWE-Bench Pro 分数是多少?
官方未单独公布 GPT-5.6 Sol 的 SWE-Bench Pro 分数,我们没有查到可靠的公开数据,因此本页不填这个数字,也不会用其他榜单的分数替代或估算。
Fable 5 的 80.3% 能直接拿来跟别的模型比吗?
要谨慎。这个分数是 Anthropic 自有评测框架(scaffolding)产出的,不是中立第三方复现的结果,独立评测机构给出的表现与之有出入。详细的口径拆解见站内专文《SWE-Bench Pro:Fable 5 跑分到底怎么算的》。
处理一个中等复杂度的 PR,两个模型大概要花多少钱?
这里只能给估算,不是实测数据:假设一个中等复杂度 PR 消耗约 15 万输入 token、2 万输出 token,Fable 5 约合 $1.5(输入)+ $1.0(输出)= 约 $2.5;Sol 约合 $0.75(输入)+ $0.6(输出)= 约 $1.35。实际消耗因代码库大小、上下文长度和任务复杂度差异很大,务必用自己的真实任务重新核算。
在 QCode 上能同时用这两个模型吗?
可以,Claude Fable 5 和 GPT-5.6 Sol 目前都在 QCode 的可调用模型列表中,同一把 key 即可切换使用,不需要分别开通。
相关指南
Claude Fable 5 定价完全指南
输入/输出价格、缓存计价与账单细节
SWE-Bench Pro:Fable 5 跑分到底怎么算的
80.3% 评测口径拆解与独立复现对照
GPT-5.6 Sol vs Terra vs Luna 怎么选
GPT-5.6 三档定位与选型建议
本站与 Anthropic、OpenAI 均无隶属关系。价格与跑分数据以官方及权威第三方源为准,本页信息截至 2026-08-08,可能变动;成本估算仅供参考,不代表实测数据。