Grok 4.6 догнал лучшие модели OpenAI и стоит в три раза дешевле

Когда цена становится оружием
Есть такой старый приём в технологическом бизнесе: если не можешь сразу переплюнуть конкурента по качеству — убей его ценой. xAI, похоже, решила сыграть именно эту партию, и надо признать — у неё получается убедительно. Grok 4.6 вышел тихо, без грандиозных презентаций, но с цифрами, которые заставляют задуматься даже самых преданных поклонников Anthropic и OpenAI.
Что говорят бенчмарки — и почему им стоит верить
Artificial Analysis Intelligence Index — один из наиболее честных агрегированных рейтингов на сегодня, потому что он не опирается на один тест, а суммирует десятки независимых замеров. Так вот: Grok 4.6 набрал 61 балл, встав вровень с GPT-5.6 Sol от OpenAI. Выше — только Claude Opus 5 (63 балла) и Claude Fable 5 (62 балла). Это не «почти добрался до топа» — это реальный второй эшелон, который дышит лидерам в затылок.
Для сравнения: предыдущая версия, Grok 4.5, набирала 56 баллов. Прыжок на 5 пунктов за один релиз — это серьёзно. Примерно такой же темп роста показывал GPT-4 Turbo в своё время, переходя от одной минорной версии к другой.
Агентные задачи — вот где всё становится интересным
Чисто языковые бенчмарки — это одно. Но реальный водораздел между моделями сейчас проходит по агентным возможностям: насколько хорошо ИИ справляется с многошаговыми задачами в реальной рабочей среде без постоянного присмотра человека.
Здесь Grok 4.6 показывает нечто неожиданное. На бенчмарке GDPval-AA v2, который имитирует реальную компьютерную работу — поиск информации, работу с файлами, взаимодействие с интерфейсами — модель занимает второе место с Elo-рейтингом 1753, уступая только Claude Opus 5. При этом для решения сложных задач Grok 4.6 использует в среднем 53 шага, тогда как Claude Opus 5 тратит около 103 шагов. Вдвое меньше итераций на ту же задачу — это не просто красивая цифра, это прямая экономия токенов, времени и денег при запуске агентных пайплайнов.
Мне это напоминает разницу между джуниором, который долго ходит по кругу, и опытным специалистом, который решает задачу напрямую. Меньше шагов — значит более связная цепочка рассуждений и лучшее понимание контекста.
Цена — главный аргумент
Теперь про деньги, потому что именно здесь xAI бьёт конкурентов наотмашь.
Grok 4.6 стоит $2 за миллион входящих токенов и $6 за миллион исходящих.
Для сравнения: - Claude Opus 5: $5 / $25 — в 2,5 и более чем в 4 раза дороже на выходе - GPT-5.6 Sol: $5 / $30 — сопоставимо по входу, но пятикратная разница на выходе
Если вы строите агентную систему, где модель генерирует много текста, разница в стоимости исходящих токенов становится определяющей. При сопоставимом качестве платить в 4–5 раз меньше — это не просто экономия, это смена бизнес-модели для стартапов и независимых разработчиков.
Доступность и экосистема
Grok 4.6 уже доступен через API xAI, интегрирован в Cursor (один из самых популярных AI-редакторов кода), работает через Grok Build, а также подключён к партнёрским платформам — OpenRouter, Vercel, Cloudflare. Первую неделю после релиза xAI предлагает двойную квоту использования в Grok Build и Cursor — классический маркетинговый ход, но вполне разумный для привлечения разработчиков.
Для российских пользователей: API xAI технически работает, но потребует VPN и карты иностранного банка или криптоплатёж. Cursor и OpenRouter — те же условия. Прямой оплаты российскими картами нет, ситуация стандартная для западных AI-сервисов в 2026 году.
Что это значит для рынка
xAI планомерно выстраивает стратегию «достаточно хорошо, но намного дешевле». Это не попытка стать лучшим — это попытка стать самым выгодным в верхнем ценовом сегменте. Anthropic и OpenAI держат лидерство по качеству, но их ценовая политика явно рассчитана на корпоративных клиентов с большими бюджетами.
Grok 4.6 целится в тех, кто строит продукты в реальном времени: стартапы, indie-разработчики, небольшие команды. Для них разница между $6 и $25 за миллион токенов на выходе — это разница между прибыльностью и убытками.
Лично я считаю, что xAI делает правильную ставку. Рынок больших языковых моделей всё больше напоминает рынок облачных вычислений середины 2010-х: качество у топовых игроков выравнивается, и победит тот, кто предложит лучшее соотношение цены и производительности. Grok 4.6 — серьёзная заявка именно на эту позицию.
Посмотрим, как отреагируют Anthropic и OpenAI. Ценовые войны в AI только начинаются.
Источники
Похожие новости
OpenAI распустила команду по катастрофическим рискам ИИ
OpenAI тихо ликвидировала отдел Preparedness, который оценивал угрозы от собственных моделей. Сотрудники говорят о нарастающем «чувстве тревоги и ответственности».
Optima: бенчмарки ИИ наконец-то на ваших реальных данных
Artificial Analysis запустила платформу Optima, которая позволяет строить персональные бенчмарки для LLM на основе собственных данных и сравнивать модели не только по качеству, но и по стоимости задачи.
ИИ-книги затопили Amazon и режут доходы живых авторов
Исследование 14 000 книг показало: ИИ-контент занял 20% каталога, но забирает лишь 12% выручки — зато тянет вниз доходы всех авторов без исключения.