Место #6 Программирование — ИИ, который пишет код для продакшена
xAI

Grok 4.7

Grok 4.7 — самая дешёвая серьёзная модель для программирования рядом с вершиной рейтинга. За $2 за ввод и $6 за вывод на миллион токенов она набирает 71,0 % в DeepSWE и 46,3 % в CursorBench 4.0 и работает прямо в Cursor и Grok Build. Это сильный напарник для повседневного программирования, но пока не тот агент, которого можно на несколько часов оставить одного в терминале.

Обновлено 27 сентября 2026 DeepSWE 71.0%CursorBench 46.3%Cursor & Grok Build
Лучше всего для

Grok 4.7 — самая дешёвая серьёзная модель для программирования рядом с вершиной рейтинга. За $2 за ввод и $6 за вывод на миллион токенов она набирает 71,0 % в DeepSWE и 46,3 % в CursorBench 4.0 и работает прямо в Cursor и Grok Build. Это сильный напарник для повседневного программирования, но пока не тот агент, которого можно на несколько часов оставить одного в терминале.

Почему он побеждает

По стартовой таблице xAI: CursorBench 4.0 вырос с 40,4 % до 46,3 %, DeepSWE v1.1 — с 65,2 % до 71,0 % (высокое усилие), а Terminal-Bench 4.0 почти удвоился — с 20,3 % до 37,6 %. Цена осталась $2/$6, есть быстрая версия — вдвое быстрее за двойную цену. Доступна в Cursor, Grok Build (можно попробовать бесплатно), через API Grok и в сторонних инструментах для программирования.

Обратите внимание

В долгой автономной работе в терминале она по-прежнему сильно отстаёт от лидеров: 37,6 % в Terminal-Bench 4.0 против 57,9 % у Claude Fable 5.1 и 59,6 % у GPT-6 Astra и Claude Opus 5.5 в независимых тестах. В CursorBench она позади Fable 5.1 (51,8 %). Все цифры по Grok — от самой xAI.

01

Что это на самом деле

Каждый разработчик работал рядом с двумя типами коллег.

Первая — блестящая и дотошная, на любой вопрос читает пятнадцатиминутную лекцию. Второй просто наклоняется к вашей клавиатуре, набирает сорок строк, запускает тесты и говорит: «Попробуй так».

В линейках OpenAI и Anthropic больше всего титулов собирает дотошная и дорогая коллега. Grok 4.7 — тот самый быстрый, достаточно дешёвый, чтобы спрашивать его сто раз на дню.

Grok 4.7 вышла 21 сентября 2026 года и занимает пятое место в нашем рейтинге программирования. Её роль — быть самым выгодным напарником по программированию среди лидеров.

Улучшения, которые важны разработчикам

Grok 4.6 была интересным претендентом. Grok 4.7 делает явный шаг вперёд во всех тестах по программированию, которые опубликовала xAI:

  • DeepSWE v1.1, сложные инженерные задачи в реальных кодовых базах: с 65,2 % до 71,0 % (на высоком усилии). В таблице xAI это чуть выше, чем 70,0 % у Claude Fable 5.1.
  • CursorBench 4.0, более длинные задачи программирования в редакторе Cursor: с 40,4 % до 46,3 %.
  • Terminal-Bench 4.0, многочасовая работа в командной строке: с 20,3 % до 37,6 %, почти вдвое.

xAI объясняет прогресс более крупной базовой моделью, гораздо более долгим обучением на задачах, занимающих часы, и целенаправленной работой над тем, чтобы модель проверяла свои ответы и справлялась с длинным контекстом. На практике это значит меньше брошенных на полпути правок и меньше уверенно сказанных ошибок.

Экономика программирования в редакторе

Когда вы программируете в Cursor или похожем редакторе, к ИИ обращаются не раз в день, а постоянно. Он читает ваши файлы, предлагает правки, объясняет ошибку, переписывает функцию — и всё по новой.

При цене $2 за миллион входных токенов и $6 за миллион выходных у Grok 4.7 самая низкая цена вывода среди лучших моделей для программирования. Для сравнения: GPT-6 Sol стоит $10, Claude Opus 5.5 — $20, GPT-6 Astra — $50. Если вы весь день работаете в редакторе, эта разница — вполне реальные деньги.

Есть и быстрая версия, которая выдаёт текст вдвое быстрее за двойную цену. Она пригодится, когда вы ждёте каждый ответ.

Где её пока не хватает

Долгие прогоны без присмотра. Terminal-Bench 4.0 лучше всего предсказывает, можно ли оставить агента одного в терминале на несколько часов. 37,6 % у Grok 4.7 — большое улучшение, но GPT-6 Astra и Claude Opus 5.5 в независимых тестах набирают по 59,6 %, а Fable 5.1 в собственной таблице xAI — 57,9 %. В автономной ночной работе эти модели сбиваются с пути гораздо реже.

Лучшие результаты в редакторе. В CursorBench 4.0 Grok позади Claude Fable 5.1 (51,8 %) и 57,8 %, которые Anthropic сообщает для Claude Opus 5.5.

Новейшие конкуренты. xAI сравнивает Grok 4.7 с GPT-5.6 Sol и Fable 5.1. GPT-6 Sol вышла на следующий день по похожей цене, а независимого прямого сравнения мы пока не видели. Все цифры по Grok здесь — от самой xAI.

Итог

Для долгих прогонов агентов без присмотра выбирайте GPT-6 Astra. Для глубокой архитектурной работы над большой кодовой базой — Claude Opus 5.5.

Но для тех часов, что вы каждый день проводите в редакторе, исправляя ошибки, пиша тесты и рефакторя компоненты, Grok 4.7 — сильный, быстрый и очень недорогой напарник. Проверьте её на своём коде против GPT-6 Sol: скорее всего, одна из двух станет вашим повседневным инструментом.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Самая низкая цена рядом с вершиной: $2 за миллион входных токенов и $6 за миллион выходных. По выводу это дешевле, чем GPT-6 Sol ($10), Claude Opus 5.5 ($20) и GPT-6 Astra ($50). В редакторе, который обращается к модели постоянно, разница накапливается.
  • Надёжное исправление ошибок в реальных проектах: в DeepSWE v1.1, где проверяются сложные инженерные задачи в реальных кодовых базах, Grok 4.7 набрала 71,0 % на высоком усилии против 65,2 % у Grok 4.6. По данным xAI, это чуть выше, чем у Claude Fable 5.1 (70,0 %).
  • Лучше работает в редакторе: CursorBench 4.0 измеряет более длинные задачи программирования в редакторе Cursor. Grok 4.7 улучшила результат с 40,4 % до 46,3 %, и xAI называет её в этом тесте «передовой по соотношению цены и качества».
  • Дольше не теряет нить: xAI обучала её на задачах, которые занимают много часов, и улучшила то, как модель проверяет свою работу и справляется с длинным контекстом. Именно эти навыки не дают агенту отвлечься посреди правки.
  • Доступна там, где работают разработчики: с первого дня встроена в Cursor и Grok Build, а также доступна через API Grok, другие инструменты для программирования и маршрутизаторы моделей. Быстрая версия вдвое ускоряет вывод для интерактивной работы.

Честные ограничения

  • Пока не готова к долгим сессиям в терминале без присмотра: Terminal-Bench 4.0, который проверяет многочасовую работу в командной строке, вырос до 37,6 %. Это большой скачок, но до примерно 58–60 % у Fable 5.1, GPT-6 Astra и Claude Opus 5.5 ещё далеко.
  • Отстаёт от лидеров в задачах в редакторе: её 46,3 % в CursorBench 4.0 ниже, чем у Fable 5.1 (51,8 %), и ниже 57,8 %, которые Anthropic сообщает для Claude Opus 5.5.
  • Сравнивалась с конкурентами прошлого месяца: таблица xAI сопоставляет Grok 4.7 с GPT-5.6 Sol и Fable 5.1, а не с GPT-6 Sol, которая вышла на следующий день по похожей цене.
  • Только данные производителя: все цифры по Grok здесь взяты у xAI. Мы обновим статью, когда появятся независимые результаты.
03

Результаты тестов

DeepSWE v1.1 — 71,0 % (высокое усилие)

Сложные инженерные задачи в реальных кодовых базах. Рост с 65,2 % у Grok 4.6. В таблице xAI у Claude Fable 5.1 — 70,0 %, у GPT-5.6 Sol (максимальное усилие) — 72,7 %.

CursorBench 4.0 — 46,3 %

Более длинные задачи программирования в редакторе Cursor. Рост с 40,4 %; в той же таблице у Claude Fable 5.1 — 51,8 %, у GPT-5.6 Sol — 41,7 %.

Terminal-Bench 4.0 — 37,6 %

Многочасовая работа в командной строке. Почти вдвое больше 20,3 % у Grok 4.6, но далеко позади 57,9 % у Claude Fable 5.1 в таблице xAI. (Собственный прогон Anthropic даёт Fable 5.1 55,8 %; независимые тесты дают GPT-6 Astra и Claude Opus 5.5 по 59,6 %.)

Цена — $2 / $6 за 1 млн токенов

Без изменений по сравнению с Grok 4.6. Быстрая версия работает с удвоенной скоростью вывода за двойную цену.

04

Вердикт

Grok 4.7 — наша модель для программирования № 5 и лучший выбор, если для вас важнее всего стоимость каждого нажатия клавиши. Для повседневной работы в редакторе — исправлять ошибки, писать тесты, рефакторить — это по-настоящему толковый напарник с самой низкой ценой вывода среди лидеров. В долгих сессиях в терминале без присмотра она пока сильно уступает GPT-6 Astra и Claude Opus 5.5. Прежде чем определиться, проверьте её на собственном коде против ближайшего конкурента по цене — GPT-6 Sol.

05

Часто задаваемые вопросы