对比 · 同一张表

Pro 0813 vs Fable 5
TB2.1 打平,DeepSWE 仍是 Fable

在 DeepSeek 自己的 0813 表里,Terminal-Bench 2.1 是 87.9 对 88.0,几乎打平,Fable 5 一列标注 w/ fallback。真正的分水岭是价格:$0.435/$0.87 对 $10/$50。

#TB2.1 87.9 vs 88.0#DeepSWE 62.7 vs 70#HLE 60 vs 63#Open vs closed

要点

87.9 vs 88.0

TB 2.1

基本打平。此处是 Terminal-Bench 2.1;Grok 官方发布表用的是 TB v3.0,两套分数不可直接比较。

62.7 vs 70.0

DeepSWE

Fable 5(w/ fallback)仍领先难编码 agent 行。

60.0 vs 63.0

HLE 带工具

Fable 53.3/63.0 vs Pro 42.7/60.0(无/有工具)。

$0.87 vs site

输出价

V4 Pro 当前输出价 $0.87/M;Claude Fable 5 官方标价为输入 $10/M、输出 $50/M。

这场对位

这个搜索问的是 0813 能不能当 Fable 平替。在 DeepSeek 自己的格子里,终端基准是同级,DeepSWE、Toolathlon 和内部 fullstack 仍落后。

为什么在热

社区曾拿 4 月的 V4 Pro Preview 在 Baba-is-bench 上当笑点。那批 29% 的成绩属于 Preview 版本,0813 正式版在该评测上没有公开成绩。

时间线

2026-08-13

Pro 0813 GA + 含 Fable-5 w/ fallback 的 HF 对照表。

Fable 5 仍是 Anthropic 高端叙事;价格以站内既有 Fable 页为准。

2026-08-16

DeepSeek 峰谷价。仍远低于 Fable 档 API 账单。

怎么引用 HF 格

表上

下表只取 DeepSeek 在 Hugging Face 发布的 0813 同源表格,其中 Fable 5 一列标注为 w/ fallback。Cybergym 83.3 对 83.1,可以视为打平。

表外

三个常见误读:把博客传闻当成 Fable 5 的官方价格、把 Preview 版本的低分算到 0813 头上、把 Terminal-Bench 2.1 与 v3.0 的分数放进同一张表。

谁选什么

要 Fable 判断力 / 品牌 / Claude 栈

留在 Fable 5 或 Opus 5。HF 格仍把更难的 agent 行给 Fable。

要开源 1.7T 和便宜一个数量级的账单

Pro 0813。自托管或官方 API。放量配 Flash 0731。

怎么用

都是 1M 上下文。产品不同:一个 MIT checkpoint,一个闭源高端模型。

在 QCode 上

QCode 的 /models 目录当前同时列有 deepseek-v4-pro 与 claude-fable-5。QCode 是多模型接入方,不隶属于任何一家模型厂商。

常见问题

0813 等于 Fable 5 吗?

不等于。TB2.1 打平;DeepSWE 和若干 agent 行落后。

为什么 Fable 要写 w/ fallback?

DeepSeek 列名如此。漏掉会夸大 Fable 或贬低 Pro。

Fable 这边能自托管吗?

不能。只有 Pro 0813 是 MIT。

Flash 0731 和这场对位?

Flash 更便宜,部分 agent 行接近;Fable 问题的 Pro 侧是 0813。

HF 表里的 Opus 4.8?

DeepSeek 把 Opus-4.8 当已公布参照,不是本页主角对手。

峰价会抹平差距吗?

不会。即使峰时 Pro 输出 $3.96 也不是 Fable 档账单。

来源

HF DeepSeek-V4-Pro-0813 表;changelog 2026-08-13;站内 Fable 定价页。

终端同级,不是 Fable 克隆

最难的 5% agent 活留 Fable;账单本身就是产品时用 0813。