Место #2 Повседневная экосистема — Ведущие ИИ-помощники
OpenAI

GPT-6 Astra

GPT-6 Astra — новый флагман OpenAI для той части работы, которая происходит за пределами окна чата. Он управляет браузером, щёлкает по приложениям на рабочем столе, доводит многошаговые профессиональные процессы до конца и проверяет собственные факты примерно вдвое лучше, чем GPT-5.6 Sol, — внутри той же экосистемы ChatGPT, Codex и API, которую вы уже знаете.

Обновлено 5 сентября 2026 AgenticChatGPT WorkComputer Use
Лучше всего для

GPT-6 Astra — новый флагман OpenAI для той части работы, которая происходит за пределами окна чата. Он управляет браузером, щёлкает по приложениям на рабочем столе, доводит многошаговые профессиональные процессы до конца и проверяет собственные факты примерно вдвое лучше, чем GPT-5.6 Sol, — внутри той же экосистемы ChatGPT, Codex и API, которую вы уже знаете.

Почему он побеждает

Независимые тесты Artificial Analysis дают Astra 61,2 в Intelligence Index — статистическая ничья с Sol, — тогда как таблицы запуска показывают 72,6% на OSWorld 2.0 (работа за компьютером) примерно за половину времени Sol, 59,3% на Agents' Last Exam, 62,7% на стандартном харнессе ARC-AGI-3 (99,9% — только с адаптером самого OpenAI), 64,6% на Terminal-Bench Science и примерно вдвое меньше галлюцинаций при более высокой точности. С первого дня доступен в ChatGPT, Codex, API, Azure и Bedrock.

Обратите внимание

Это апгрейд специалиста, а не новый рекорд IQ. Независимые оценки интеллектуальной работы (GDPval-AA) просели ниже Sol, Claude Fable 5.1 по-прежнему лидирует в сводных индексах общего интеллекта, а цена API — 2,5× Sol: $10/$50 за миллион токенов при чтении кэша за $1. Лаконичные ответы Astra потеряли очки в проверках по праву, финансам и презентациям, а запуск первого дня оставил часть платных пользователей за бортом.

01

Что это на самом деле

Каждый запуск флагмана приходит с одним и тем же плакатом: самая умная модель из когда-либо созданных. Плакат GPT-6 Astra другой — и куда более полезный. Он гласит: эта модель сама садится за клавиатуру. Astra — новый флагман OpenAI для работы вне чата: управлять браузером, щёлкать по настольным приложениям, доводить многошаговый профессиональный процесс до конца — и при этом заметно лучше проверять собственные факты.

Измеренная история соответствует анонсу. На OSWorld 2.0, тесте настольных операций, Astra набирает 72,6% и заканчивает примерно за 40 минут, где GPT-5.6 Sol требовалось около 75; Opus 5 — 70,2%. На Agents’ Last Exam, оценке долгих профессиональных процессов в 55 областях, он достигает 59,3%. А мониторинг фактологичности Artificial Analysis показывает уровень галлюцинаций примерно вдвое ниже, чем у Sol, при более высокой точности. Меньше самоуверенных ошибок, быстрее законченная работа — апгрейд, который чувствуешь уже в первую неделю.

Вот честная звёздочка. В Intelligence Index Artificial Analysis Astra набирает 61,2 — статистическая ничья с 60,9 у Sol, — а Claude Fable 5.1 лидирует с 65,7. В интеллектуальной работе GDPval-AA v2 примерно 1629 у Astra отстают от Opus 5 (1824) и Fable 5.1 (1853) — и от Sol. Если ваш день — due diligence, записки и суждения, новый флагман не автоматически лучший инструмент; это другой инструмент. А цена API — $10/$50 за миллион токенов, 2,5× Sol, чтение кэша $1 — прямо называет цену этой разницы.

Направьте работу по адресу

Задача Кому отдать Почему
«Сделай на моём компьютере»: браузер, файлы, настольные приложения, до конца Astra Лучшая измеренная работа за компьютером, примерно вдвое быстрее на задачу
Интеллектуальная работа с упором на суждение, due diligence, длинные документы Opus 5 Выше GDPval при четверти цены API
Самое сложное чистое рассуждение и длинный запутанный контекст Fable 5 / Fable 5.1 Лидирует в независимых сводных индексах
Поток, черновики, ежедневный конвейер Sol / Terra / Luna Всё ещё доступны, всё ещё самые дешёвые места

Честная оговорка

Astra лаконичен по характеру. Этот скоростной стиль выигрывает оценки по программированию и проигрывает рубрики права, финансов и налогов, где ценится перечисление каждого шага; качество презентаций просело относительно Sol даже при скачке качества анализа. Запуск первого дня был беспорядочным: платные пользователи играли в лотерею доступа, а корпоративные аккаунты получили Astra выключенным по умолчанию. Нативной генерации изображений нет, вывода звука и видео — тоже. А заметно более сильные киберспособности (100% на ExploitBench, с найденными на оценке ранее неизвестными 0-day) идут с более строгими ограничителями, которые могут замедлить легитимную околобезопасную работу.

Так что выигрышная привычка: Astra — за руль, Opus — за суждение, Fable — за трудное мышление, Sol — за конвейер. OpenAI построила не больший мозг; она построила лучшие руки. Для массы реальной работы именно это и есть важный апгрейд.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Работа за компьютером, которая доводится до конца: Astra набирает 72,6% на OSWorld 2.0 против 65,7% у Sol и 70,2% у Opus 5 и проходит набор задач примерно за 40 минут, где Sol требовалось около 75. В ChatGPT Work это превращается в агента, который листает, щёлкает, печатает и перемещает файлы, пока работа не сделана, — а вы остаётесь утверждающей инстанцией.
  • Примерно вдвое меньше галлюцинаций: мониторинг фактологичности Artificial Analysis показывает, что уровень галлюцинаций Astra снижен примерно до половины от Sol, а точность выросла примерно на четыре пункта. В профессиональной работе меньше самоуверенных ошибок ценнее ещё одного балла на экзамене.
  • Серьёзный научный коллега: Astra набирает 64,6% на Terminal-Bench Science — против 52,6% у Fable 5.1 и 22,4% у Sol — и около 97,6% на FrontierMath Tier 4. На оценке он даже выдал доказательства двух из 68 открытых проблем Эрдёша — это исследовательская деталь, а не обещание продукта.
  • Мышцы для новых задач: на стандартном харнессе ARC-AGI-3 Astra достигает 62,7% — примерно вдвое больше 30,2% у Opus 5. Цифра 99,9%, которую вы могли видеть, требует провайдерского адаптера OpenAI с компакцией; считайте 62,7% честным сопоставимым числом.
  • Преемственность экосистемы: Astra с первого дня встроен в ChatGPT Work, Codex, настольное приложение и Sites, с идентификатором API gpt-6-astra, листингами в Azure и Bedrock, Zero Data Retention для подходящих API-сценариев, контекстом около 1,05 млн токенов и поддержкой в первый же день в таких инструментах, как Devin.

Честные ограничения

  • Это не скачок общего интеллекта: Artificial Analysis ставит Astra на 61,2 против 60,9 у Sol — ничья, — тогда как Claude Fable 5.1 лидирует с 65,7. В интеллектуальной работе GDPval-AA v2 примерно 1629 у Astra отстают от Opus 5 (1824) и Fable 5.1 (1853) — и от Sol. Если ваш день — это записки, due diligence и суждения, Astra не автоматически лучшая покупка.
  • Премиальная экономика: API стоит $10/$50 за миллион входных/выходных токенов — 2,5× Sol — с чтением кэша за $1 (Fable 5.1 берёт $0,25), записью за $12,50, удвоенной ценой входа для промптов свыше 272 тыс. токенов и двойной ценой в быстром режиме. Artificial Analysis считает Astra примерно на 75% дороже в расчёте на задачу индекса интеллекта, чем Sol, несмотря на расход примерно на 10% меньше токенов.
  • Ограничения стиля и сложности с доступом: Astra лаконичен, поэтому теряет пункты рубрик в проверках по праву, финансам и налогам, а качество презентаций просело относительно Sol даже при скачке качества анализа. Запуск первого дня был сумбурным — доступ Enterprise поставлялся выключенным по умолчанию, — нативной генерации изображений нет, как и вывода звука и видео. Усиленные кибер-ограничители замедляют часть легитимной околобезопасной работы, а показатели в собственных таблицах OpenAI слегка корректировались после публикации: закладывайте погрешность в ±1–2 пункта для каждого значения.
03

Результаты тестов

OSWorld 2.0 — Astra 72,6% за ~40 мин

Таблица работы за компьютером от OpenAI: против 65,7% у Sol (~75 мин) и 70,2% у Opus 5. Измерено на частичном офлайн-наборе задач — сильный направленный сигнал, но не гарантия для ваших приложений.

Artificial Analysis Intelligence Index — 61,2

Независимый сводный индекс: ничья с GPT-5.6 Sol (60,9) и позади Claude Fable 5.1 (65,7). Честный заголовок — модель стала более автономной (агентной), а не просто «умнее».

Мониторинг фактологичности AA — галлюцинаций примерно вдвое меньше

Независимый замер: примерно половина уровня галлюцинаций Sol при точности выше примерно на четыре пункта — то изменение надёжности, которое профессионалы реально чувствуют.

ARC-AGI-3 — 62,7% стандарт / 99,9% с адаптером провайдера

Решение новых интерактивных задач. 62,7% — сопоставимая цифра стандартного харнесса (Opus 5: 30,2%); 99,9% включает харнесс Responses и компакцию OpenAI и всегда должно идти с этой сноской.

Цены API — $10/$50 · чтение кэша $1 · запись $12,50

За 1 млн входных/выходных токенов, плюс 2× вход / 1,5× выход для промптов свыше 272 тыс. токенов и 2× в быстром режиме. Сравнивайте стоимость выполненной задачи и поведение кэша, а не ценники.

04

Вердикт

GPT-6 Astra забирает у GPT-5.6 второе место в повседневной категории, потому что это самый сильный агент работы за компьютером и научных задач внутри самой широкой потребительской платформы — ChatGPT Work, Codex, десктоп, Sites и API. Opus 5 сохраняет первое место по суждению на доллар в чистой интеллектуальной работе, а Fable 5 остаётся специалистом по интеллекту. Выбирайте Astra, когда задача звучит как «сделай это на моём компьютере и закончи»; выбирайте Opus 5, когда результат — это суждение; оставьте Sol, Terra и Luna для потока задач по прежним ценам.

05

Часто задаваемые вопросы