Kimi K3 vs Opus 5
点は重なり、製品は違う
第三者の集計では Opus 5 の総合力がやや上で、K3 とレンジは重なります。K3 の強みは 2.8T のオープンウェイト、約 4 割安い価格、そしてネイティブの視覚対応です。Moonshot 自身も、総合では Fable 5 と GPT-5.6 Sol に及ばないと認めています。
ハイライト
K3 規模
16/896 MoE、KDA+AttnRes、ネイティブ視覚、1M。
より安い token
K3 $3/$15 vs よく引用の Opus 5 $5/$25(要確認)。
集計
BenchLM 系は約 83 vs 80、区間重なり。
K3 ブログ
総合ではまだ Fable 5 と GPT-5.6 Sol に劣る。
この対戦
K3 の目玉として紹介されるカーネル最適化、MiniTriton、チップ設計、ゲーム生成といった事例は、Moonshot 自身が公開した能力デモです。K3 が何を得意とするかを示すものであり、これらのタスクで Opus 5 が劣ることの証拠ではありません。同一条件の比較実験は併せて公開されていないからです。
なぜ話題か
K3 記事の制限:thinking 履歴を全部返す。過剰に先回りし得る。体験はまだ Fable/Sol に劣る。この頁に書く。
タイムライン
K3 GA + ブログ。
重み公開予定(商用条項は license 確認)。
第三者の vs Opus 5 記事。
確認と注意
確認
公式 K3 仕様/価格/制限。重なりある第三者集計。閉源旗艦としての Opus 5。
注意
両者のレンジは重なっており、どちらかが圧倒しているわけではありません。Moonshot の公式ブログは、K3 が総合では Fable 5 と GPT-5.6 Sol に及ばないと明記しています。価格は Claude Opus 5 が公式で入力 $5/M・出力 $25/M、Kimi K3 が入力 $3/M・出力 $15/M です。
選び方
Opus 5
独立集計の最上、Claude スタック、速度に敏感なコーディング(評で約 2×)。
K3
オープン 2.8T、視覚+コード、$3/$15。supernode を飼えるならセルフホスト。
使い方
K3 は Kimi API/Work/Code。Opus 5 は既存 Claude 経路。Work と Opus 5 ガイドを相互リンク。
QCode
QCode の /models には現在 kimi-k3 と claude-opus-5 の両方が掲載されており、同じ key で比較できます。
FAQ
K3 は Opus 5 に勝った?
きれいな勝利はない。集計は重なり、Opus がだいたい前。
価格差?
$3/$15 vs $5/$25 で約 40%。要確認。
ローカル K3?
2.8T。公式は 64+ アクセラレータ supernode。16G の話ではない。
thinking 履歴?
K3 は thinking の全再生を求める。途中のモデル切替は荒れ得る。
Fable 5 との比較では?
Moonshot は K3 の公式ブログで、総合的な能力は依然として Claude Fable 5 と GPT-5.6 Sol に及ばない一方、多くの指標で他のオープンモデルを上回ると自ら述べています。この一文を踏まえて第三者のランキングを読むと、より正確に理解できます。
この勝負の DeepSeek 0813 は?
あります。DeepSeek が Hugging Face で公開した 0813 の同一出典グリッドには Kimi K3 の行も含まれています(HLE 43.5/56.0、Terminal-Bench 2.1 88.3、DeepSWE 67.5、Toolathlon 76.5)。完全な表は /deepseek-v4-pro-0813 でご覧いただけます。
出典
K3 公式ブログ。BenchLM/CodingFleet 系(第三者)。本サイト Opus 5。
関連
Moonshot / Anthropic とは無関係。