Qwen3.8 Max и Kimi K3: сравнение, цены, бенчмарки — NetRoom
← В блог
НОВОСТИ 5 августа 2026 г. 6 мин чтения

Qwen3.8 Max и Kimi K3: два китайских флагмана за две недели

Alibaba выкатила модель на 2,4 трлн параметров, Moonshot — крупнейшие открытые веса в мире. Разобрали, чем они отличаются, сколько стоят и когда какую брать.

Коротко

За две недели вышли два китайских флагмана. Kimi K3 от Moonshot AI — 27 июля, 2,8 триллиона параметров и крупнейшие открытые веса в мире. Qwen3.8 Max от Alibaba — 3 августа, 2,4 триллиона параметров и нативная мультимодальность. У обеих контекст на миллион токенов. Обе теперь в каталоге NetRoom.

Если совсем сжато: Qwen дешевле почти втрое по выходным токенам и умеет видео на входе. Kimi сильнее на фронтенде и отдаёт веса, которые можно скачать и развернуть у себя.

Qwen3.8 Max: ставка на автономность

Alibaba показала модель на конференции WAIC в Шанхае 19 июля, а в общий доступ выкатила 3 августа. Внутри — разреженная MoE-архитектура на 2,4 триллиона параметров, из которых на каждый запрос активируется около 95 миллиардов. Для сравнения, прошлое поколение Qwen3.6 Max Preview (20 апреля) было втрое меньше по общему размеру.

Контекст — 1 000 000 токенов, максимальная длина ответа — 131 072 токена. На вход модель принимает текст, изображения и видео.

Главный акцент релиза — агентная работа. По внутренним прогонам Alibaba модель вела автономную разработку дольше десяти дней подряд: писала код, запускала собственные тесты, читала логи и итерировала без человека. В другом тесте она с нуля воспроизвела исследовательскую статью по машинному обучению — 33 раунда обучения на GPU, около 125 часов, 7 600 строк кода, после чего предложила 18 идей улучшений, часть из которых обошла метод из оригинальной статьи.

По бенчмаркам прирост против 3.6 заметный:

  • Terminal-Bench 2.1 — 86,6 против 51,5 у Qwen3.6 на версии 2.0
  • SWE-bench Pro — 67,7 против 49,5

На Arena.AI модель сразу стала первой среди китайских по текстовым задачам и второй в мире по vision — впереди только вариант Claude Fable 5. Открытые веса Alibaba обещала выложить следом за релизом, на момент публикации их ещё не было.

Kimi K3: самые большие открытые веса

Moonshot выпустила K3 27 июля и сразу отдала веса на свободное скачивание. 2,8 триллиона параметров — это крупнейшая открытая модель из опубликованных. Прошлая K2.6 (тоже 20 апреля) была на 1 триллион с 32 миллиардами активных на токен и брала другим: системой Agent Swarm на 300 специализированных субагентов и прогонами до 4 000 согласованных шагов.

Контекст у K3 — тот же миллион токенов. Модель заточена под навигацию по большим репозиториям, вызов инструментов, отладку и итерации по логам, тестам и скриншотам.

Цифры по бенчмаркам:

  • Frontend Code Arena — первое место, 1679 баллов, выше Claude Fable 5 в слепом тестировании разработчиками
  • GDPval-AA v2 — 1687, третье место после Claude Fable 5 Max (1815) и GPT-5.6 Sol Max (1747,8), выше Claude Opus 4.8 (1600)
  • AA-Briefcase — 1527, второе место, обгоняет GPT-5.6 Sol Max (1495), уступает Fable 5 Max (1587)

Отдельная деталь: спрос после релиза оказался такой, что Moonshot временно ограничивала доступ к модели. И ещё одна — при сопоставимом качестве K3 запускается заметно легче конкурентов, что для открытых весов принципиально: их ведь кто-то должен реально поднять.

Цены: главная развилка

Здесь модели расходятся сильнее всего.

  • Qwen3.8 Max — 2 доллара за миллион входных токенов, 6 за миллион выходных.
  • Kimi K3 — около 2,90 за миллион входных и 14 за миллион выходных. У Moonshot напрямую вход стоит 3 доллара, но на кэш-хите падает примерно до 0,30.

То есть на выходных токенах Kimi дороже Qwen в 2,3 раза. Для чата и коротких ответов разница не критична, для агентных прогонов, где модель генерит тысячи строк кода, она превращается в основную статью расходов. При этом K3 подорожала относительно собственной K2.6 примерно в пять раз — Moonshot явно переставила модель в другой ценовой сегмент.

Кэширование у Kimi частично это компенсирует: если гоняете длинные диалоги с повторяющимся системным промптом и одной и той же кодовой базой в контексте, реальный счёт будет заметно ниже прайса.

Когда какую брать

Qwen3.8 Max — когда важна цена за объём и нужен разбор картинок или видео. Длинные агентные прогоны, анализ документов пачками, работа с большим проектом целиком. Плюс сильный русский без кальки с английского.

Kimi K3 — когда делаете фронтенд и вёрстку (первое место в Arena тут не случайность), когда нужна отладка по логам и скриншотам, или когда принципиальны открытые веса: возможность скачать модель и не зависеть от того, что вендор завтра поменяет правила или цены.

Обе модели доступны в NetRoom — в браузере, без VPN и зарубежной карты, с оплатой в рублях и тарификацией по факту потраченных токенов. Карточки: Qwen3.8 Max и Kimi K3.

Что это значит в целом

Две недели, два релиза, обе модели вплотную к верхушке мировых рейтингов, обе дешевле западных флагманов. Год назад китайские модели обсуждали в логике «догоняют». Сейчас Kimi K3 занимает первое место во Frontend Code Arena, а Qwen3.8 Max — второе в мире по vision. Разрыв, если он и остался, измеряется уже не поколениями, а позициями в таблице.

Попробовать все нейросети на одном балансе

Текст, изображения, видео и звук — один кабинет NetRoom вместо десятка подписок.

Начать бесплатно

Ещё в блоге