已发布 · 2026-08-12

Grok 4.6
回到前沿,价没涨

SpaceXAI 2026-08-12 发布,偏长程 agent 和视觉/交互第一稿。Cursor、Grok Build、API、OpenRouter。首周 2× 包含用量。

#Grok 4.6#AA 61#$2 / $6#500K ctx

要点

61

AA 智指

与 Sol 持平;低于 Opus 5 max 63、Fable 5 max 62。

$2 / $6

输入 / 输出

与 4.5 标价相同。缓存命中 $0.30→$0.50。fast 变体 2× 价。

500K

上下文

与 4.5 相同,不是 1M。

65.9%

DeepSWE v1.1

官方 4.6 表上落后 Sol 73% 与 Fable 70%。

4.6 是什么

Grok 4.6 是在 4.5 基础上做的更长 supplemental 训练,加上用 4.5 重新生成的 SFT 数据,而不是一次全新的预训练。xAI 没有为 4.6 公布参数量;早期部分博客写的「2T」与后来创始人谈 4.7 时的说法相互矛盾,本页因此不列参数量。

为什么在热

传播最广的是 Artificial Analysis 的效率对比:在 Briefcase 上 Grok 4.6 约 53 个回合、0.5B 输入,Opus 5 约 103 个回合、2.0B 输入。注意两套 Terminal-Bench 分数不能并列——xAI 官方表用的是 TB v3.0(26%),Artificial Analysis 引用的是 TB v2.1(88.4%)。

时间线

2026-07-08/16

Grok 4.5 发布期。

2026-07-24/28

Musk 预告 4.6 然后 4.7。

2026-08-12

4.6 GA——比约 8-07 暗示晚几天。

已确认 vs 小心

已确认

发布稿 + 评测表;AA 2026-08-12 文;$2/$6;500K;Cursor/Build 首周 2×。

小心 / 传闻

三点容易搞错:4.6 的参数量 xAI 没有公布,网上流传的 2.1T 是创始人对 4.7 的说法;Terminal-Bench v3.0 与 2.1 是两套不同的量表,不能放进同一列;fast 变体是两倍价格,不是免费提速。

怎么选

选 4.6

长程 agent、视觉应用、用 $2/$6 对冲 Opus/Sol 账单、Cursor/Build 用户。

选别的

要 1M 上下文,或最高 DeepSWE,或 Claude/OpenAI 原生栈。

怎么用

console.x.ai / Cursor / x.ai/build。模型看 /models。

在 QCode 上

QCode 目前没有接入 Grok 系列,/models 目录里没有任何 Grok 型号。如果你要找同价位或同能力档的替代,目录里现有 claude-opus-5、gpt-5.6-sol、deepseek-v4-pro 与 kimi-k3。

常见问题

4.6 发布了吗?

是。2026-08-12。

比 Opus 5 强吗?

AA 61 vs 63。更便宜、回合更少。不是击倒。

比 4.5 强吗?

AA 56→61,长程 agent 强很多。缓存命中变贵。

上下文是 1M 吗?

不是。500K。

4.7 呢?

未发布。另有追踪页。

TB 26% 看起来很差?

那是发布表上的 Terminal-Bench v3.0。AA 的 TB v2.1 是 88.4%。不同测试。

来源

x.ai/news/grok-4-6;AA 2026-08-12 文。

用已经存在的 Grok

4.6 是活 id。4.7 是标题。