Представьте лоукостер, который оставляет цены на билеты прежними, но без лишнего шума пересаживает пассажиров на самолёт побольше и получше.
Примерно это xAI сделала с Grok 4.7, вышедшей 21 сентября 2026 года. Цена не изменилась: $2 за миллион входных токенов и $6 за миллион выходных — ровно как у Grok 4.6. Изменилась сама модель.
Что нового под капотом
xAI описывает три изменения, если говорить простыми словами:
- Более крупная базовая модель. По словам xAI, версия 4.7 построена на более крупном фундаменте, чем 4.6. Число параметров в анонсе не названо, так что любые конкретные цифры, которые вы встретите в других местах, считайте неподтверждёнными.
- Более долгое и жёсткое обучение. Модель обучали с подкреплением на задачах, которые занимают много часов, — как раз на той работе, где прежние модели теряли нить на полпути.
- Проверка собственной работы. xAI специально обучала её перепроверять ответы и надёжнее справляться с длинными документами.
В итоге получилась модель, которая лучше держится на длинной задаче и замечает собственные ошибки раньше вас.
Чем она нас удивила
Самые интересные цифры в стартовой таблице xAI — вовсе не про программирование. Они относятся к областям, где от бюджетной модели не ждёшь лидерства.
- Юридическая работа. В Harvey Legal Agent Benchmark, тесте на то, насколько хорошо ИИ-агент справляется с реальными юридическими задачами, Grok 4.7 набрала 19,6 %. Это больше, чем у Claude Fable 5.1 (6,7 %) и GPT-5.6 Sol (2,5 %). Тест беспощадно трудный, и у всех результаты низкие, но в этом сравнении Grok оказалась первой.
- Инженерная математика. В EEBench, где проверяются задачи по электротехнике, она набрала 64,0 % — больше, чем 56,4 % у Fable 5.1.
- Офисная работа. В AA Briefcase, тесте многочасовых офисных задач вроде подготовки документов и презентаций, она получила 1657 — чуть меньше 1678 у Fable 5.1 и намного больше 1546 у Grok 4.6.
Проще говоря, в реальной офисной и профессиональной работе Grok 4.7 теперь играет в одной лиге с моделями, которые стоят в несколько раз дороже.
Безопаснее, чем гласит репутация
У Grok репутация чат-бота с минимумом ограничений. Для версии 4.7 эта репутация устарела. xAI, по её словам, построила полностью новую систему безопасности и называет модель своей самой надёжной в отказе от опасных запросов и в устойчивости к джейлбрейкам. Кроме того, компания утверждает, что модель редко блокирует законную работу — например, исследования в области защитной кибербезопасности.
Grok по-прежнему скорее отвечает прямо, чем обкладывает ответ предупреждениями. Но это вопрос стиля, а не отсутствия безопасности.
Честная оговорка
С новейшими конкурентами она ещё не встречалась. Таблица xAI сравнивает Grok 4.7 с GPT-5.6 Sol и Claude Fable 5.1. Через день после её выхода Anthropic выпустила Claude Opus 5.5, а OpenAI — GPT-6 Sol: оба сильные и недорогие соперники. Пока независимые тесты не поставят их рядом, точное место Grok остаётся неясным.
Долгая работа в терминале — по-прежнему слабое место. В Terminal-Bench 4.0, который проверяет многочасовую работу в командной строке, Grok 4.7 набрала 37,6 %. Это почти вдвое больше, чем у Grok 4.6, но далеко позади 57,9 % у Fable 5.1.
Медицина — не её конёк. В HealthBench Professional, тесте на клиническое мышление, она набрала 56,7 % — меньше, чем GPT-5.6 Sol и Fable 5.1.
Всё это — цифры xAI. Лидерство в юриспруденции и инженерии впечатляет, но мы хотели бы увидеть его независимое подтверждение.
Кому подойдёт
Если вы весь день работаете с ИИ над документами, аналитикой и техническими вопросами и ежемесячный счёт для вас важен, Grok 4.7 заслуживает серьёзной проверки. Она даёт бо́льшую часть качества лучших моделей за малую долю их цены.
Если вам нужно самое тщательное суждение из доступных, выбирайте Claude Opus 5.5. Если нужен агент, который будет работать с программами на вашем компьютере, выбирайте GPT-6 Astra. Для всего, что между этими крайностями, Grok 4.7 — самый выгодный вариант рядом с вершиной.