Grok 4.6
回到前沿,价没涨
SpaceXAI 2026-08-12 发布,偏长程 agent 和视觉/交互第一稿。Cursor、Grok Build、API、OpenRouter。首周 2× 包含用量。
要点
AA 智指
与 Sol 持平;低于 Opus 5 max 63、Fable 5 max 62。
输入 / 输出
与 4.5 标价相同。缓存命中 $0.30→$0.50。fast 变体 2× 价。
上下文
与 4.5 相同,不是 1M。
DeepSWE v1.1
官方 4.6 表上落后 Sol 73% 与 Fable 70%。
4.6 是什么
Grok 4.6 是在 4.5 基础上做的更长 supplemental 训练,加上用 4.5 重新生成的 SFT 数据,而不是一次全新的预训练。xAI 没有为 4.6 公布参数量;早期部分博客写的「2T」与后来创始人谈 4.7 时的说法相互矛盾,本页因此不列参数量。
为什么在热
传播最广的是 Artificial Analysis 的效率对比:在 Briefcase 上 Grok 4.6 约 53 个回合、0.5B 输入,Opus 5 约 103 个回合、2.0B 输入。注意两套 Terminal-Bench 分数不能并列——xAI 官方表用的是 TB v3.0(26%),Artificial Analysis 引用的是 TB v2.1(88.4%)。
时间线
Grok 4.5 发布期。
Musk 预告 4.6 然后 4.7。
4.6 GA——比约 8-07 暗示晚几天。
已确认 vs 小心
已确认
发布稿 + 评测表;AA 2026-08-12 文;$2/$6;500K;Cursor/Build 首周 2×。
小心 / 传闻
三点容易搞错:4.6 的参数量 xAI 没有公布,网上流传的 2.1T 是创始人对 4.7 的说法;Terminal-Bench v3.0 与 2.1 是两套不同的量表,不能放进同一列;fast 变体是两倍价格,不是免费提速。
怎么选
选 4.6
长程 agent、视觉应用、用 $2/$6 对冲 Opus/Sol 账单、Cursor/Build 用户。
选别的
要 1M 上下文,或最高 DeepSWE,或 Claude/OpenAI 原生栈。
怎么用
console.x.ai / Cursor / x.ai/build。模型看 /models。
在 QCode 上
QCode 目前没有接入 Grok 系列,/models 目录里没有任何 Grok 型号。如果你要找同价位或同能力档的替代,目录里现有 claude-opus-5、gpt-5.6-sol、deepseek-v4-pro 与 kimi-k3。
常见问题
4.6 发布了吗?
是。2026-08-12。
比 Opus 5 强吗?
AA 61 vs 63。更便宜、回合更少。不是击倒。
比 4.5 强吗?
AA 56→61,长程 agent 强很多。缓存命中变贵。
上下文是 1M 吗?
不是。500K。
4.7 呢?
未发布。另有追踪页。
TB 26% 看起来很差?
那是发布表上的 Terminal-Bench v3.0。AA 的 TB v2.1 是 88.4%。不同测试。
来源
x.ai/news/grok-4-6;AA 2026-08-12 文。