Пока эксперты спорят о принципах, инженерные команды выкатывают продукт — и за одни сутки индустрия получила сразу несколько моделей, которые меняют не то, что умеет AI, а то, сколько это стоит.
xAI выпустила Grok 4.6 — по независимым оценкам Artificial Analysis, модель показывает результат почти на уровне GPT-5.6 и немного уступает лидерам вроде Claude Opus, но при этом стоит 2–6 долларов за миллион токенов — заметно дешевле конкурентов такого уровня. В агентных задачах, вроде работы с терминалом, модель показала почти 90% успеха, а вместе с ней xAI запустила Grok Bot — AI-«напарника», который сам заходит в ваши рабочие инструменты и приносит готовый результат. Илон Маск уже анонсировал, что следующая версия, 4.7, находится в разработке.
Alibaba ответила открытой моделью Qwen3.8-Max на 2.4 триллиона параметров (95 миллиардов из них активны одновременно) — один из крупнейших релизов с открытыми весами на сегодняшний день. Инфраструктурные партнёры вроде vLLM и Together AI обеспечили поддержку в день релиза, что говорит о серьёзности намерений компании закрепиться в этой нише. Есть нюанс: открытая версия пока работает только с текстом, без обработки изображений.
Главный удар по ценам нанесла DeepSeek: релиз V4 Pro оценили примерно в 57 раз дешевле топовых моделей вроде Claude Fable, при этом с заметным приростом качества по сравнению с предыдущей версией. По силе модель не всегда обгоняет конкурентов вроде Kimi, но экономика говорит сама за себя — дальнейшие успехи DeepSeek, судя по всему, будут строиться не на масштабе, а на более умном обучении с подкреплением.
За этими тремя релизами прячется общий сюжет: компании больше не соревнуются исключительно в том, «кто умнее». Битва сместилась в сторону эффективности — кто даст сравнимое качество за меньшие деньги и меньшее время. Для конечного пользователя это хорошая новость: доступ к мощному AI дешевеет буквально на глазах, а инструменты вроде GitHub Agent Plugins или обновлённого LangSmith показывают, что вокруг самих моделей вырастает целая экосистема агентов, способных работать самостоятельно. Вопрос в том, куда эта гонка на скорость и дешевизну приведёт в вопросах безопасности — учитывая, что именно об этом весь день спорили Хинтон, Ын и Ли в паре кварталов от презентации Grok Bot.
Во что углубиться:
- Что такое Mixture-of-Experts архитектура в AI: почему модели вроде Qwen активируют не все параметры сразу
- Как считают Intelligence Index и AA-Briefcase: методология независимых бенчмарков Artificial Analysis
- Гонка AI-агентов для разработчиков: чем Grok Bot отличается от Devin и GitHub Copilot
