对比 · 都已发布

Grok 4.6 vs Opus 5
AA 只差一分,输出价差约四倍

数据取自 Artificial Analysis 2026-08-12 的评测文与 Grok 4.6 官方发布表。Opus 5 的智能指数 63 仍略高于 4.6 的 61,而 4.6 的输出价约为 Opus 5 的四分之一。

#61 vs 63#$2/$6 vs $5/$25#53 vs 103 turns#500K vs check

要点

61 vs 63

AA

Opus 5 max 63,Grok 4.6 61,Sol 61,Fable 62。

$2/$6 vs $5/$25

标价

Opus 5 $5/$25 是常用引用——上线核 Anthropic。

53 vs 103

AA-Briefcase 回合

输入也约 0.5B vs 2.0B。效率才是 4.6 的故事。

DeepSWE

65.9% vs 73% Sol / 70% Fable

Grok 4.6 的 DeepSWE 为 65.9%。4.6 官方发布表没有列出 Opus 5 的 DeepSWE 成绩,因此这一项没有同源对照。编码仍不是 Grok 的强项。

这场对位

这是「能不能丢掉 Opus 5 省钱」的搜索。答案:让出 AA 的一分和部分编码基准,换价格和回合数。

为什么在热

4.6 自己的表上 Harvey LAB 15.8% vs Sol 2.5%——可以当有趣 callout,不是主线。

时间线

2026-08-12

4.6 与 AA 文同一天。

Opus 5 已有站内 /claude-opus-5-guide。

TB note

发布表 TB v3.0 26% vs Fable 34.1% / Sol 34.6%。与 TB 2.1 分开。

已确认 vs 小心

已确认

AA 61 vs 63;$2/$6 vs 常引 $5/$25;Briefcase 53 vs 103 回合;500K vs 既有 Opus 页上的窗口。

小心

两个常见误用:给 Opus 5 补一个并不存在的 DeepSWE 分数;把 Grok 官方表的 Terminal-Bench v3.0 拿去和 DeepSeek 的 TB 2.1 比较。Opus 5 的官方标价为输入 $5/M、输出 $25/M。

怎么选

选 Opus 5

要最强判断力、Claude 栈、AA 一分和编码基准比账单重要时。

选 Grok 4.6

预算内长程 agent、Cursor/Build、回合更省的 Briefcase 类工作。

怎么用

两者都是在售产品。互链 /grok-4-6-guide 与 /claude-opus-5-guide。

在 QCode 上

QCode 的 /models 目录当前列有 claude-opus-5,但没有接入 Grok 系列。本页是能力与价格对比,不代表两者都能在 QCode 上调用。

常见问题

谁赢?

Opus 5 赢 AA 和多数编码行;4.6 赢价格和回合。

$5/$25 是官价吗?

常用引用;请核 Anthropic/QCode 定价页。

500K 对 Opus 够吗?

看仓库。4.6 不是 1M 模型。

首周 2×?

Cursor/Build 的发布促销会过期;常青 FAQ 里要写日期。

为什么这里比的是 4.6 而不是 4.7?

4.7 没出。用 4.7 追踪页。

这场里 Fable 5?

AA 62,挨着 4.6 的 61。要那一对就另开页。

来源

AA Grok 4.6 文;x.ai 4.6 表;既有 Opus 5 页的窗口/价格。

AA 一分之差,输出账单约四倍

整页就这句话。两边都别吹过头。