Есть два способа нанять кодинг-агента. Можно привлекать самого звёздного консультанта в городе на каждый тикет или взять отличного инженера, который работает достаточно быстро и недорого, чтобы сделать ещё одну попытку, если первая не удалась. Grok 4.5 — это второй вариант, и это весомый комплимент.
Artificial Analysis ставит Grok Build на третье место в индексе кодинг-агентов с оценкой 76: наравне с GPT-5.5 в Codex и позади Fable 5 в Claude Code. Главный аргумент в пользу покупки — цена. Тот же анализ оценивает стоимость в $2,49 за агентскую задачу для Grok Build против $5,07 у GPT-5.5 в Codex и $11,80 у Fable 5 в Claude Code. При этом Grok тратит значительно меньше токенов.
Именно поэтому Grok 4.5 остается сильным четвертым после прихода Kimi K3. График xAI показывает его почти наравне с лидерами в Terminal-Bench 2.1 с результатом 83,3% и впереди в SWE Marathon с 29,0% pass@1. Модель доступна в Cursor на всех тарифах и является стандартом в Grok Build. Длинные агентские циклы, работа в терминале, многошаговая отладка и изучение репозиториев становятся доступными для повторения.
О чём не стоит заявлять
Grok 4.5 не является новым королём чистых баллов. Его 64,7% в SWE-Bench Pro уступают 80,4% у Fable 5 и 69,2% у Opus 4.8. Результаты в DeepSWE также следуют за Fable и GPT-5.5. Если ваш рабочий процесс состоит исключительно из бенчмарков по решению сложных issue, лидеры по-прежнему удерживают преимущество.
Что делать вместо этого
Запускайте Grok 4.5 на задачах, где способный агент улучшает результат за счёт дополнительного цикла: исследование, работа в терминале, рефакторинг, тесты и итеративная разработка приложений. Инвестируйте сэкономленный бюджет в проверку кода. Переходите к GPT-5.6 или Fable 5, когда задача докажет, что ей необходим их технический потолок.
Главный вывод для программирования простой: Grok 4.5 — не самый дорогой молоток. Это отличный электроинструмент, который можно позволить себе держать включённым постоянно.