Год назад разговор про китайские open-weight модели звучал вежливо-снисходительно: догоняют, стараются, но до топа далеко. Kimi K3 закрыл эту тему одним релизом. Реакция сообщества — не вежливые кивки, а искреннее удивление: разработчики массово пишут, что модель «действительно очень хороша», а исследователь Руслан Салахутдинов лично поздравил основателя Moonshot Чжилиня Яна.
Цифры подтверждают эмоции. По индексу интеллекта Artificial Analysis K3 набрала 57 баллов — это ставит её между Claude Fable 5 (60) и Opus 4.8 (56). На агентном кодинге K3 показала те же 57 баллов, что и GPT-5.6 Terra и GPT-5.5, обойдя Opus 4.8, а на тесте Terminal-Bench v2 выдала 84%. Самый показательный момент — Frontend Code Arena, бенчмарк по вёрстке интерфейсов: K3 впервые вывела Китай на первое место, обогнав все американские модели. Это символический перелом.
Единого мнения, насколько K3 близка к фронтиру, нет. Одни называют её моделью, которую «уже невозможно игнорировать», другие настаивают, что по скрытым бенчмаркам и общей универсальности отставание в несколько месяцев сохраняется. Но даже скептики признают: раньше о китайских моделях так не спорили — раньше просто фиксировали разрыв.
Главный вывод: гонка перестала быть предсказуемой. Полгода назад казалось, что фронтир — клуб из двух-трёх американских лабораторий. Сейчас, по подсчётам Artificial Analysis, выше порога в 51 балл индекса интеллекта работают уже шесть лабораторий. Это произошло за полтора месяца.
Во что углубиться:
- Kimi Delta Attention: архитектура памяти, которая позволяет K3 обрабатывать контекст в 1 миллион токенов в 6 раз быстрее и дешевле обычных механизмов внимания
- MoE-архитектуры (Mixture of Experts): как маршрутизация запросов между «экспертами» модели снижает вычислительные затраты без потери качества
- Moonshot AI и стек Mooncake: инфраструктурные решения китайской лаборатории, разработанные в условиях ограниченного доступа к передовым чипам
