Grok 4.6
前線に復帰、価格は $2/$6 のまま
SpaceXAI は 2026-08-12、長時間エージェントと視覚/対話の初稿に焦点。Cursor、Grok Build、API、OpenRouter。初週 2×。
ハイライト
AA 知能
Sol と同点。Opus 5 max 63、Fable 5 max 62 より下。
入力 / 出力
4.5 と同じ表示。キャッシュヒット $0.30→$0.50。fast は 2×。
コンテキスト
4.5 と同じで 1M ではない。
DeepSWE v1.1
公式 4.6 表では Sol 73%、Fable 70% に劣る。
4.6 とは
Grok 4.6 は 4.5 を土台にした長めの supplemental 学習と、4.5 で再生成した SFT データによるもので、新規の事前学習ではありません。xAI は 4.6 のパラメータ数を公表していません。初期のブログにある「2T」は、のちに創業者が 4.7 について述べた内容と矛盾するため、本ページではパラメータ数を示しません。
なぜ話題か
最も拡散したのは Artificial Analysis の効率比較です。Briefcase で Grok 4.6 は約 53 ターン・入力 0.5B、Opus 5 は約 103 ターン・2.0B でした。なお二つの Terminal-Bench の数値は並べられません。xAI の公式表は TB v3.0(26%)、Artificial Analysis は TB v2.1(88.4%)を引用しています。
タイムライン
Grok 4.5 発売期。
Musk が 4.6 のあと 4.7 を予告。
4.6 GA。8/7 前後の示唆より数日遅い。
確認と注意
確認
発表記事と評価表。AA 2026-08-12。$2/$6。500K。Cursor/Build 初週 2×。
注意 / 噂
混同されやすい三点。4.6 のパラメータ数は xAI が公表しておらず、出回っている 2.1T は創業者が 4.7 について語った数字です。Terminal-Bench の v3.0 と 2.1 は別の尺度で同じ列に置けません。fast 版は 2 倍の料金であり、無料の高速化ではありません。
選び方
4.6 を選ぶ
長時間エージェント、視覚アプリ、$2/$6 で Opus/Sol 請求をヘッジ、Cursor/Build。
別を選ぶ
1M コンテキスト、最高 DeepSWE、Claude/OpenAI ネイティブが要るとき。
使い方
console.x.ai / Cursor / x.ai/build。モデルは /models。
QCode
QCode は現在 Grok シリーズを取り扱っておらず、/models に Grok の型番はありません。同等の性能帯で代替を探す場合、カタログには claude-opus-5、gpt-5.6-sol、deepseek-v4-pro、kimi-k3 が掲載されています。
FAQ
4.6 は出た?
はい。2026-08-12。
Opus 5 より強い?
AA 61 vs 63。安くターンも少ない。ノックアウトではない。
4.5 より強い?
AA 56→61。長時間エージェントは大幅に強い。キャッシュヒットは高くなった。
コンテキストは 1M?
いいえ。500K。
4.7 は?
未発売。別トラッカー。
TB 26% はひどく見える?
発表表の Terminal-Bench v3.0。AA の TB v2.1 は 88.4%。別試験。
出典
x.ai/news/grok-4-6;AA 2026-08-12 記事。