Grok 4.7 vs Claude Fable 5
4.7 のスコアボードはない
検索需要は本物。4.7 が Fable 5 に勝った表は本物ではない。このページはクエリを取り、4.6 の代理数字を示し、噂を噂と書く。
更新日 2026-09-21
守れるスコアボード
同一出典の比較は無い
xAI は Grok 4.7 のベンチを出していない。「4.7 が Fable 5 に勝った」は推測。
現行代理:4.6 vs Fable 5
Grok 4.6 公式表:AA 61 vs Fable 5 Max 62。
DeepSWE v1.1
Grok 4.6 65.9% vs Fable 5 Max 70%。コーディングでは Fable 寄り。
4.7 の主張
Musk 氏:2.1T、4.6 よりほぼ上、提供はわずかに遅く token 効率は良い。カードではない。
なぜこの対戦が検索されるか
Fable 5 は Anthropic の上位物語。Grok 4.6 の AA は1点差。4.7 の大きな事前学習が差を埋めると思われている。重みと評価が出るまではトラッカーと 4.6 代理表が正直。
議論の分かれ目
2.1T と SpaceX データで長時間エージェントを超える、という側。4.6 は DeepSWE と TB v3.0 でまだ負けており、小幅な事前学習ではコーディングはひっくり返らない、という側。どちらも 4.7 の公式数値を挙げていない(両側とも 2026-09-22 確認)。
このクエリの年表
2026-07-24/28 に同時予告。4.7 は 2.1T と説明。
2026-08-12 に出荷。Grok 4.6 は Fable 5 Max との公式表付き。これまでで唯一の公平な数字。
2026-09-22 取得分でも 4.7 の単独カードは無し。この URL は検索用であり偽レビューではない。
既知と未知
既知(表に使う)
2026-09-22 に xAI の公式モデルカタログで確認:grok-4.7 は flagship として載っていて、Context 500k tokens、Input $2.00 / 1M tokens、Output $6.00 / 1M tokens、知識カットオフは May 2026。同じカタログページに 4.7 単独のモデルカード、公開日、ベンチマーク得点は無い。よってこのページの数量比較は Grok 4.6 と Fable 5 Max の公式公表値に置き、それは代理指標であって 4.7 の成績ではない。
未知(4.7 の行は空欄)
価格とコンテキストは 2026-09-22 付けで公式ページに出たため、この欄から外れた。残る欠測は AA、DeepSWE、Fable 5 との直接比較。数字が出た日に本番比較へ切り替える。
4.7 前の選び方
今すぐ Fable 級の判断が要る
Claude Fable 5 / Opus 5 に残る。現行表ではコーディングはわずかに Fable。
今すぐ安い前線近傍が要る
Grok 側は 4.7 も出荷済みの 4.6 も公式価格 $2/$6。対比できる公開スコアは今も 4.6 のものだけ。
4.7 が出たら
本ページは現在、Grok 4.6 の実データを代理行として使用しています。xAI が 4.7 の公式モデルカードとベンチマークを公表した時点で、この行は 4.7 自身の数値に置き換えられ、Fable 5 Max と w/ fallback の表記はそのまま維持されます。それまで 4.6 のスコアを 4.7 の見出しの下に置くことはありません。
QCode について
xAI のカタログは grok-4.7 を載せていて、QCode は Grok シリーズを取り扱っていません。ただし /models には claude-fable-5 が掲載されているため、本比較の Claude 側はそのまま利用できます。
Grok 4.7 vs Fable 5 FAQ
Grok 4.7 は Fable 5 に勝った?
分からない。2026-09-22 に x.ai を再確認、Grok 4.7 の公開ベンチは依然ない。
なぜこのページを置く?
完全一致の検索がすでに走っている。偽スコアを拒めば、正直なトラッカーの方が遅いレビューより先にランクする。
一番近い実比較は?
Grok 4.6 vs Fable 5 Max の公式表。コーディングは Fable がわずかに上。AA は 62 vs 61。
2.1T なら自動で Fable 5 に勝つ?
パラメータ数はベンチではない。4.6 は価格とターン効率が AA の1点と同じくらい大事だと示した。
4.7 を待つために Fable 5 の案件を遅らせるべきですか?
おすすめしません。まずは Claude Fable 5 か Grok 4.6 で成果物を出し、4.7 に公式モデルカードと同一出典のベンチマークが揃ってから移行を検討してください。
TB v3.0 と TB 2.1 は同じ列?
できません。Grok の公式発表表は Terminal-Bench v3.0、DeepSeek の表は 2.1 を使っており、別の尺度です。同じ「TB」列にまとめると誤った結論になります。
出典
出典:x.ai/news/grok-4-6 の公式評価表、2026 年 7 月の報道が伝えた創業者の発言、Anthropic 公式料金ページの Claude Fable 5 価格。2026-09-22 に取得した docs.x.ai のモデルページは grok-4.7 を 4.6 と並べ flagship と表記するが、単独のモデルカードとベンチマーク結果は無い。
関連
SpaceXAI / Anthropic とは無関係。Grok 4.7 のスコアは主張しません。