Grok 4.6 vs Opus 5
AA は1点差、出力価格は約4倍
数値は Artificial Analysis の 2026-08-12 の記事と Grok 4.6 公式発表表によります。知能指数では Opus 5 が 63 対 61 でなお上、一方 4.6 の出力単価は Opus 5 の約 4 分の 1 です。
ハイライト
AA
Opus 5 max 63、Grok 4.6 61、Sol 61、Fable 62。
表示価格
Opus 5 の $5/$25 はよく引用。公開時に Anthropic を確認。
AA-Briefcase ターン
入力も約 0.5B vs 2.0B。効率が 4.6 の話。
65.9% vs 73% Sol / 70% Fable
Grok 4.6 の DeepSWE は 65.9%。4.6 の公式発表表には Opus 5 の DeepSWE が載っていないため、この行に同一出典の対照はありません。コーディングは依然として Grok の強みではありません。
この対戦
「Opus 5 を捨てて節約できるか」。AA の1点と一部コーディングを渡し、価格とターンを得る。
なぜ話題か
4.6 自身の表では Harvey LAB 15.8% vs Sol 2.5%。面白い呼び水であり主線ではない。
タイムライン
4.6 と AA 記事が同日。
Opus 5 は本サイト /claude-opus-5-guide。
発表表 TB v3.0 26% vs Fable 34.1% / Sol 34.6%。TB 2.1 とは別。
確認と注意
確認
AA 61 vs 63。$2/$6 vs 引用 $5/$25。Briefcase 53 vs 103。500K vs 既存 Opus ページの窓。
注意
よくある二つの誤り:公表されていない Opus 5 の DeepSWE スコアを補ってしまうこと、Grok 公式表の Terminal-Bench v3.0 を DeepSeek の TB 2.1 と比べてしまうこと。Opus 5 の公式価格は入力 $5/M、出力 $25/M です。
選び方
Opus 5
最大の判断、Claude スタック、AA の1点とコーディングが請求より大事なとき。
Grok 4.6
予算内の長時間エージェント、Cursor/Build、ターン効率の良い Briefcase 系。
使い方
どちらも販売中。/grok-4-6-guide と /claude-opus-5-guide を相互リンク。
QCode
QCode の /models には現在 claude-opus-5 が掲載されていますが、Grok シリーズは取り扱っていません。本ページは性能と料金の比較であり、両方を QCode で呼び出せるという意味ではありません。
FAQ
どちらが勝つ?
AA と多くのコーディングは Opus 5。価格とターンは 4.6。
$5/$25 は公式?
よく引用。Anthropic/QCode の料金ページで確認。
500K は Opus に対して足りる?
リポジトリ次第。4.6 は 1M モデルではない。
初週 2×?
Cursor/Build の発売プロモは期限付き。常設 FAQ には日付を。
なぜ 4.7 ではなく 4.6 を比較しているのですか?
4.7 は未発売。4.7 トラッカーへ。
この話の Fable 5 は?
AA 62 で 4.6 の 61 の隣。そのペアは別ページ。
出典
AA Grok 4.6 記事;x.ai 4.6 表;既存 Opus 5 ページの窓/価格。