Ранжированное руководство

Повседневная экосистема — Ведущие ИИ-помощники

Это швейцарские ножи искусственного интеллекта — помощники, которых открывают раньше почты. Они пишут, рассуждают, планируют и порой с впечатляющей уверенностью выдумывают. Сейчас Claude Opus 5.5 лидирует во вдумчивой, проверяемой интеллектуальной работе, Claude Sonnet 5.5 даёт почти такие же результаты в офисной работе даже на бесплатном тарифе Claude, GPT-6 Astra сильнее всех управляет программами за вас, а GPT-6.1 Sol даёт в ChatGPT Work результаты почти уровня Astra за малую долю стоимости. Вот что каждый из них делает хорошо, где спотыкается и почему правильный выбор зависит от того, как выглядит ваш день.

Сначала решение

Наш рейтинг

Начните с победителя, затем сравните компромиссы, которые могут изменить ваш выбор.

#1 Повседневная экосистема

Claude Opus 5.5

Anthropic

Claude Opus 5.5 — модель, которой мы доверили бы запутанную задачу с высокой ценой ошибки и были бы спокойны, что получим верный ответ. По словам Anthropic, в большинстве задач она работает на уровне флагманской Fable 5.1, но стоит меньше половины её цены за токен. А пишет теперь как собранный опытный коллега, а не как волнующийся выпускник.

Почему он побеждает

Лучший результат в независимом Artificial Analysis Intelligence Index на момент выхода (58 при максимальном усилии). Лидирует в GDPval-AA v2.1 — тесте на реальную профессиональную работу — с 1846 Elo, опережая Fable 5.1 (1735). Цена токенов снизилась на 20 %, до $4/$20, а чтение из кэша — на 60 %, до $0,20; по оценке Anthropic, типичная нагрузка обходится примерно на 40 % дешевле, чем с Opus 5. Ответы генерируются более чем на 30 % быстрее, а пятичасовые лимиты на платных тарифах выросли.

В чем подвох

На максимальном усилии модель очень много «думает вслух»: Artificial Analysis насчитала около 119 000 выходных токенов на задачу против примерно 27 000 у GPT-6 Astra. Поэтому низкая цена окупается, только если рутинная работа идёт на стандартном уровне усилия. Изображения модель не создаёт, рассуждение больше нельзя отключить, а большинство запросов по кибербезопасности незаметно передаются старой Opus 4.8.

9.8 Оценка редакции
Читать обзор
Лучше всего для

Claude Opus 5.5 — модель, которой мы доверили бы запутанную задачу с высокой ценой ошибки и были бы спокойны, что получим верный ответ. По словам Anthropic, в большинстве задач она работает на уровне флагманской Fable 5.1, но стоит меньше половины её цены за токен. А пишет теперь как собранный опытный коллега, а не как волнующийся выпускник.

Почему он побеждает

Лучший результат в независимом Artificial Analysis Intelligence Index на момент выхода (58 при максимальном усилии). Лидирует в GDPval-AA v2.1 — тесте на реальную профессиональную работу — с 1846 Elo, опережая Fable 5.1 (1735). Цена токенов снизилась на 20 %, до $4/$20, а чтение из кэша — на 60 %, до $0,20; по оценке Anthropic, типичная нагрузка обходится примерно на 40 % дешевле, чем с Opus 5. Ответы генерируются более чем на 30 % быстрее, а пятичасовые лимиты на платных тарифах выросли.

Обратите внимание

На максимальном усилии модель очень много «думает вслух»: Artificial Analysis насчитала около 119 000 выходных токенов на задачу против примерно 27 000 у GPT-6 Astra. Поэтому низкая цена окупается, только если рутинная работа идёт на стандартном уровне усилия. Изображения модель не создаёт, рассуждение больше нельзя отключить, а большинство запросов по кибербезопасности незаметно передаются старой Opus 4.8.

#2

GPT-6 Astra

OpenAI

GPT-6 Astra — новый флагман OpenAI для той части работы, которая происходит за пределами окна чата. Он управляет браузером, щёлкает по приложениям на рабочем столе, доводит многошаговые профессиональные процессы до конца и проверяет собственные факты примерно вдвое лучше, чем GPT-5.6 Sol, — внутри той же экосистемы ChatGPT, Codex и API, которую вы уже знаете.

9.8 Оценка редакции
Читать обзор
#3

Claude Fable 5.1

Anthropic

Те же веса, что и у эксклюзивной Mythos 5.1, но с уровнем безопасности, который получает большинство пользователей. Это модель, которую Anthropic советует использовать, когда Opus 5 при высоких усилиях не справляется с вашими частными тестами — длительное программирование, многочасовые исследования и документы, которые должны оставаться связными.

9.8 Оценка редакции
Читать обзор
#4

Claude Sonnet 5.5

Anthropic

Claude Sonnet 5.5 — помощник для обычной рабочей недели: пересказать документы, собрать таблицу или презентацию, набросать отчёт. В независимых тестах офисной работы она отстаёт от Opus 5.5 всего на пару пунктов, доступна на бесплатном тарифе Claude, а её токены в API стоят вдвое меньше. Правда, Opus знает больше фактов и лучше справляется с по-настоящему запутанными задачами.

9.7 Оценка редакции
Читать обзор
#5

GPT-6.1 Sol

OpenAI

GPT-6.1 Sol — это повседневная рабочая модель OpenAI: та, которой вы поручаете отчеты, PDF-файлы и многошаговые задачи в ChatGPT Work. В независимых тестах она отстает всего на один балл от GPT-6 Astra, флагмана OpenAI, но при этом типичная задача обходится менее чем в четверть стоимости. Она хорошо читает длинные документы и делает меньше фактических ошибок, чем модель, которую заменяет. По заявлению OpenAI, она также может управлять настольными приложениями почти так же хорошо, как Astra.

9.6 Оценка редакции
Читать обзор
#6

Gemini 3.1 Pro

Google DeepMind

Gemini 3.1 Pro—специалист Google по глубокому мышлению: уже не новый флагман, но всё ещё силён в науке, незнакомой логике, длинных документах и мультимодальном исследовании. Семейство Flash быстрее и дешевле; 3.1 Pro нужен там, где качество анализа важнее скорости.

9.6 Оценка редакции
Читать обзор
#7

Grok 4.7

xAI

Grok 4.7 сохраняет низкую цену Grok 4.6 — $2 за ввод и $6 за вывод на миллион токенов, — но это заметно более сильная и аккуратная модель. xAI обучала её на более длинных и трудных задачах и научила перепроверять собственную работу. Это самый выгодный способ получить помощь почти топового уровня в офисной работе, подготовке юридических черновиков и инженерной математике.

9.6 Оценка редакции
Читать обзор
#8

Qwen3.8-Max

Alibaba / Qwen Team

У Qwen3.8 теперь есть две важные версии: хост-продукт Qwen3.8-Max с функциями зрения, встроенными инструментами и контекстом по умолчанию на 1 миллион токенов, а также первый скачиваемый чекпойнт класса Max от Qwen. Открытая версия — это текстовая модель на 2,4 триллиона параметров в целом и 95 миллиардов активных, с нативным контекстом 262К, который можно расширить примерно до одного миллиона токенов.

9.0 Оценка редакции
Читать обзор
Вопросы и ответы

Часто задаваемые вопросы