Kimi K3 vs Opus 5
Очки пересекаются, продукты разные
По сторонним агрегатам Opus 5 немного впереди в целом, но диапазоны с K3 пересекаются; сильные стороны K3 — открытые веса на 2.8T, примерно на 40% меньшая цена и нативное зрение. Сама Moonshot признаёт, что модель всё ещё уступает Fable 5 и GPT-5.6 Sol.
Главное
Масштаб K3
16/896 MoE, KDA+AttnRes, нативное зрение, 1M.
Дешевле токены
K3 $3/$15 против часто цитируемых $5/$25 Opus 5 (проверьте).
Агрегаты
Страницы вроде BenchLM ~83 vs ~80, интервалы пересекаются.
Блог K3
В целом всё ещё позади Fable 5 и GPT-5.6 Sol.
Пара
Показательные примеры K3 — оптимизация ядер, MiniTriton, проектирование чипов, генерация игр — это демонстрации возможностей, опубликованные самой Moonshot. Они показывают, что K3 умеет хорошо, но не доказывают, что Opus 5 проигрывает на этих задачах: сопоставимого прямого сравнения к ним не приложено.
Почему в тренде
Ограничения из поста K3: возвращать всю thinking-историю; бывает слишком проактивен; UX ещё позади Fable/Sol. Это на эту страницу.
Лента
GA K3 + блог.
Обещаны веса (коммерческую оговорку сверьте в license).
Сторонние тексты vs Opus 5.
Факты и осторожность
Подтверждено
Официальные спеки/цена/ограничения K3; сторонние агрегаты с пересечением; Opus 5 как закрытый флагман.
Осторожно
Диапазоны пересекаются, и ни одна модель не доминирует. В блоге Moonshot прямо сказано, что по совокупности K3 уступает Fable 5 и GPT-5.6 Sol. По цене: официальный прайс Claude Opus 5 — $5/M на вход и $25/M на выход, у Kimi K3 — $3/M и $15/M.
Как выбрать
Opus 5
Лучшие независимые агрегаты, стек Claude, кодинг чувствительный к скорости (в обзорах ~2×).
K3
Открытый 2.8T, зрение+код, $3/$15, self-host если потянете supernode.
Как пользоваться
K3 — через API/Work/Code Kimi. Opus 5 — через существующие пути Claude. Перелинковка Work + гид Opus 5.
На QCode
В каталоге /models на QCode сейчас есть и kimi-k3, и claude-opus-5, так что сравнить их можно одним ключом.
FAQ
K3 сильнее Opus 5?
Чистой победы нет. Агрегаты пересекаются; Opus обычно впереди.
Разрыв в цене?
Около 40% по котировке $3/$15 vs $5/$25 — проверьте.
Локальный K3?
2.8T. Официальный намёк: supernode 64+ ускорителей. Это не история про 16G.
История thinking?
K3 хочет полный replay thinking. Смена модели посреди сессии бывает скверной.
Или vs Fable 5?
В собственном блоге о K3 Moonshot пишет, что по совокупности возможностей модель всё ещё уступает Claude Fable 5 и GPT-5.6 Sol, опережая при этом другие открытые модели по ряду показателей. С этой фразой в голове сторонние рейтинги читаются гораздо точнее.
Где DeepSeek 0813?
Да. В той же исходной сетке 0813, опубликованной DeepSeek на Hugging Face, есть и строка Kimi K3 (HLE 43.5/56.0, Terminal-Bench 2.1 88.3, DeepSWE 67.5, Toolathlon 76.5); полная таблица — на /deepseek-v4-pro-0813.
Источники
Официальный блог K3; сравнения в духе BenchLM/CodingFleet (третья сторона); страницы Opus 5.
Ещё
Kimi Work
Как гонять длинные задачи K3.
Трекер K3
Хронология выпуска K3 и статус открытия весов.
Гид Opus 5
Главная страница закрытой стороны.
Не связаны с Moonshot или Anthropic.