比較 · 両方稼働

Grok 4.6 vs Opus 5
AA は1点差、出力価格は約4倍

数値は Artificial Analysis の 2026-08-12 の記事と Grok 4.6 公式発表表によります。知能指数では Opus 5 が 63 対 61 でなお上、一方 4.6 の出力単価は Opus 5 の約 4 分の 1 です。

#61 vs 63#$2/$6 vs $5/$25#53 vs 103 turns#500K vs check

ハイライト

61 vs 63

AA

Opus 5 max 63、Grok 4.6 61、Sol 61、Fable 62。

$2/$6 vs $5/$25

表示価格

Opus 5 の $5/$25 はよく引用。公開時に Anthropic を確認。

53 vs 103

AA-Briefcase ターン

入力も約 0.5B vs 2.0B。効率が 4.6 の話。

DeepSWE

65.9% vs 73% Sol / 70% Fable

Grok 4.6 の DeepSWE は 65.9%。4.6 の公式発表表には Opus 5 の DeepSWE が載っていないため、この行に同一出典の対照はありません。コーディングは依然として Grok の強みではありません。

この対戦

「Opus 5 を捨てて節約できるか」。AA の1点と一部コーディングを渡し、価格とターンを得る。

なぜ話題か

4.6 自身の表では Harvey LAB 15.8% vs Sol 2.5%。面白い呼び水であり主線ではない。

タイムライン

2026-08-12

4.6 と AA 記事が同日。

Opus 5 は本サイト /claude-opus-5-guide。

TB note

発表表 TB v3.0 26% vs Fable 34.1% / Sol 34.6%。TB 2.1 とは別。

確認と注意

確認

AA 61 vs 63。$2/$6 vs 引用 $5/$25。Briefcase 53 vs 103。500K vs 既存 Opus ページの窓。

注意

よくある二つの誤り:公表されていない Opus 5 の DeepSWE スコアを補ってしまうこと、Grok 公式表の Terminal-Bench v3.0 を DeepSeek の TB 2.1 と比べてしまうこと。Opus 5 の公式価格は入力 $5/M、出力 $25/M です。

選び方

Opus 5

最大の判断、Claude スタック、AA の1点とコーディングが請求より大事なとき。

Grok 4.6

予算内の長時間エージェント、Cursor/Build、ターン効率の良い Briefcase 系。

使い方

どちらも販売中。/grok-4-6-guide と /claude-opus-5-guide を相互リンク。

QCode

QCode の /models には現在 claude-opus-5 が掲載されていますが、Grok シリーズは取り扱っていません。本ページは性能と料金の比較であり、両方を QCode で呼び出せるという意味ではありません。

FAQ

どちらが勝つ?

AA と多くのコーディングは Opus 5。価格とターンは 4.6。

$5/$25 は公式?

よく引用。Anthropic/QCode の料金ページで確認。

500K は Opus に対して足りる?

リポジトリ次第。4.6 は 1M モデルではない。

初週 2×?

Cursor/Build の発売プロモは期限付き。常設 FAQ には日付を。

なぜ 4.7 ではなく 4.6 を比較しているのですか?

4.7 は未発売。4.7 トラッカーへ。

この話の Fable 5 は?

AA 62 で 4.6 の 61 の隣。そのペアは別ページ。

出典

AA Grok 4.6 記事;x.ai 4.6 表;既存 Opus 5 ページの窓/価格。

AA は1点、出力請求は約4倍

ページ全体がこれ。どちらも売りすぎない。