Qwen3.8 Max и Kimi K3: два китайских флагмана за две недели
Alibaba выкатила модель на 2,4 трлн параметров, Moonshot — крупнейшие открытые веса в мире. Разобрали, чем они отличаются, сколько стоят и когда какую брать.
Коротко
За две недели вышли два китайских флагмана. Kimi K3 от Moonshot AI — 27 июля, 2,8 триллиона параметров и крупнейшие открытые веса в мире. Qwen3.8 Max от Alibaba — 3 августа, 2,4 триллиона параметров и нативная мультимодальность. У обеих контекст на миллион токенов. Обе теперь в каталоге NetRoom.
Если совсем сжато: Qwen дешевле почти втрое по выходным токенам и умеет видео на входе. Kimi сильнее на фронтенде и отдаёт веса, которые можно скачать и развернуть у себя.
Qwen3.8 Max: ставка на автономность
Alibaba показала модель на конференции WAIC в Шанхае 19 июля, а в общий доступ выкатила 3 августа. Внутри — разреженная MoE-архитектура на 2,4 триллиона параметров, из которых на каждый запрос активируется около 95 миллиардов. Для сравнения, прошлое поколение Qwen3.6 Max Preview (20 апреля) было втрое меньше по общему размеру.
Контекст — 1 000 000 токенов, максимальная длина ответа — 131 072 токена. На вход модель принимает текст, изображения и видео.
Главный акцент релиза — агентная работа. По внутренним прогонам Alibaba модель вела автономную разработку дольше десяти дней подряд: писала код, запускала собственные тесты, читала логи и итерировала без человека. В другом тесте она с нуля воспроизвела исследовательскую статью по машинному обучению — 33 раунда обучения на GPU, около 125 часов, 7 600 строк кода, после чего предложила 18 идей улучшений, часть из которых обошла метод из оригинальной статьи.
По бенчмаркам прирост против 3.6 заметный:
- Terminal-Bench 2.1 — 86,6 против 51,5 у Qwen3.6 на версии 2.0
- SWE-bench Pro — 67,7 против 49,5
На Arena.AI модель сразу стала первой среди китайских по текстовым задачам и второй в мире по vision — впереди только вариант Claude Fable 5. Открытые веса Alibaba обещала выложить следом за релизом, на момент публикации их ещё не было.
Kimi K3: самые большие открытые веса
Moonshot выпустила K3 27 июля и сразу отдала веса на свободное скачивание. 2,8 триллиона параметров — это крупнейшая открытая модель из опубликованных. Прошлая K2.6 (тоже 20 апреля) была на 1 триллион с 32 миллиардами активных на токен и брала другим: системой Agent Swarm на 300 специализированных субагентов и прогонами до 4 000 согласованных шагов.
Контекст у K3 — тот же миллион токенов. Модель заточена под навигацию по большим репозиториям, вызов инструментов, отладку и итерации по логам, тестам и скриншотам.
Цифры по бенчмаркам:
- Frontend Code Arena — первое место, 1679 баллов, выше Claude Fable 5 в слепом тестировании разработчиками
- GDPval-AA v2 — 1687, третье место после Claude Fable 5 Max (1815) и GPT-5.6 Sol Max (1747,8), выше Claude Opus 4.8 (1600)
- AA-Briefcase — 1527, второе место, обгоняет GPT-5.6 Sol Max (1495), уступает Fable 5 Max (1587)
Отдельная деталь: спрос после релиза оказался такой, что Moonshot временно ограничивала доступ к модели. И ещё одна — при сопоставимом качестве K3 запускается заметно легче конкурентов, что для открытых весов принципиально: их ведь кто-то должен реально поднять.
Цены: главная развилка
Здесь модели расходятся сильнее всего.
- Qwen3.8 Max — 2 доллара за миллион входных токенов, 6 за миллион выходных.
- Kimi K3 — около 2,90 за миллион входных и 14 за миллион выходных. У Moonshot напрямую вход стоит 3 доллара, но на кэш-хите падает примерно до 0,30.
То есть на выходных токенах Kimi дороже Qwen в 2,3 раза. Для чата и коротких ответов разница не критична, для агентных прогонов, где модель генерит тысячи строк кода, она превращается в основную статью расходов. При этом K3 подорожала относительно собственной K2.6 примерно в пять раз — Moonshot явно переставила модель в другой ценовой сегмент.
Кэширование у Kimi частично это компенсирует: если гоняете длинные диалоги с повторяющимся системным промптом и одной и той же кодовой базой в контексте, реальный счёт будет заметно ниже прайса.
Когда какую брать
Qwen3.8 Max — когда важна цена за объём и нужен разбор картинок или видео. Длинные агентные прогоны, анализ документов пачками, работа с большим проектом целиком. Плюс сильный русский без кальки с английского.
Kimi K3 — когда делаете фронтенд и вёрстку (первое место в Arena тут не случайность), когда нужна отладка по логам и скриншотам, или когда принципиальны открытые веса: возможность скачать модель и не зависеть от того, что вендор завтра поменяет правила или цены.
Обе модели доступны в NetRoom — в браузере, без VPN и зарубежной карты, с оплатой в рублях и тарификацией по факту потраченных токенов. Карточки: Qwen3.8 Max и Kimi K3.
Что это значит в целом
Две недели, два релиза, обе модели вплотную к верхушке мировых рейтингов, обе дешевле западных флагманов. Год назад китайские модели обсуждали в логике «догоняют». Сейчас Kimi K3 занимает первое место во Frontend Code Arena, а Qwen3.8 Max — второе в мире по vision. Разрыв, если он и остался, измеряется уже не поколениями, а позициями в таблице.