Grok 4.6 vs Opus 5
AA 只差一分,输出价差约四倍
数据取自 Artificial Analysis 2026-08-12 的评测文与 Grok 4.6 官方发布表。Opus 5 的智能指数 63 仍略高于 4.6 的 61,而 4.6 的输出价约为 Opus 5 的四分之一。
要点
AA
Opus 5 max 63,Grok 4.6 61,Sol 61,Fable 62。
标价
Opus 5 $5/$25 是常用引用——上线核 Anthropic。
AA-Briefcase 回合
输入也约 0.5B vs 2.0B。效率才是 4.6 的故事。
65.9% vs 73% Sol / 70% Fable
Grok 4.6 的 DeepSWE 为 65.9%。4.6 官方发布表没有列出 Opus 5 的 DeepSWE 成绩,因此这一项没有同源对照。编码仍不是 Grok 的强项。
这场对位
这是「能不能丢掉 Opus 5 省钱」的搜索。答案:让出 AA 的一分和部分编码基准,换价格和回合数。
为什么在热
4.6 自己的表上 Harvey LAB 15.8% vs Sol 2.5%——可以当有趣 callout,不是主线。
时间线
4.6 与 AA 文同一天。
Opus 5 已有站内 /claude-opus-5-guide。
发布表 TB v3.0 26% vs Fable 34.1% / Sol 34.6%。与 TB 2.1 分开。
已确认 vs 小心
已确认
AA 61 vs 63;$2/$6 vs 常引 $5/$25;Briefcase 53 vs 103 回合;500K vs 既有 Opus 页上的窗口。
小心
两个常见误用:给 Opus 5 补一个并不存在的 DeepSWE 分数;把 Grok 官方表的 Terminal-Bench v3.0 拿去和 DeepSeek 的 TB 2.1 比较。Opus 5 的官方标价为输入 $5/M、输出 $25/M。
怎么选
选 Opus 5
要最强判断力、Claude 栈、AA 一分和编码基准比账单重要时。
选 Grok 4.6
预算内长程 agent、Cursor/Build、回合更省的 Briefcase 类工作。
怎么用
两者都是在售产品。互链 /grok-4-6-guide 与 /claude-opus-5-guide。
在 QCode 上
QCode 的 /models 目录当前列有 claude-opus-5,但没有接入 Grok 系列。本页是能力与价格对比,不代表两者都能在 QCode 上调用。
常见问题
谁赢?
Opus 5 赢 AA 和多数编码行;4.6 赢价格和回合。
$5/$25 是官价吗?
常用引用;请核 Anthropic/QCode 定价页。
500K 对 Opus 够吗?
看仓库。4.6 不是 1M 模型。
首周 2×?
Cursor/Build 的发布促销会过期;常青 FAQ 里要写日期。
为什么这里比的是 4.6 而不是 4.7?
4.7 没出。用 4.7 追踪页。
这场里 Fable 5?
AA 62,挨着 4.6 的 61。要那一对就另开页。
来源
AA Grok 4.6 文;x.ai 4.6 表;既有 Opus 5 页的窗口/价格。