Место #4 Повседневная экосистема — Ведущие ИИ-помощники
Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 — помощник для обычной рабочей недели: пересказать документы, собрать таблицу или презентацию, набросать отчёт. В независимых тестах офисной работы она отстаёт от Opus 5.5 всего на пару пунктов, доступна на бесплатном тарифе Claude, а её токены в API стоят вдвое меньше. Правда, Opus знает больше фактов и лучше справляется с по-настоящему запутанными задачами.

Обновлено 29 сентября 2026 Knowledge WorkFreemium1M Context
Лучше всего для

Claude Sonnet 5.5 — помощник для обычной рабочей недели: пересказать документы, собрать таблицу или презентацию, набросать отчёт. В независимых тестах офисной работы она отстаёт от Opus 5.5 всего на пару пунктов, доступна на бесплатном тарифе Claude, а её токены в API стоят вдвое меньше. Правда, Opus знает больше фактов и лучше справляется с по-настоящему запутанными задачами.

Почему он побеждает

Набирает 56 баллов в независимом Intelligence Index от Artificial Analysis на уровне max — на два меньше, чем Opus 5.5 (58). Artificial Analysis также намерила 1844 Elo в GDPval-AA v2.1 (у Opus 5.5 — 1846) и 1811 в AA-Briefcase (у Opus 5.5 — 1822). Не зная ответа, она выдумывает реже, чем Opus 5.5. Токены в API стоят 2/10 доллара, а ответ приходит более чем на 30 % быстрее, чем у Sonnet 5.

Обратите внимание

Она знает меньше фактов, чем Opus 5.5 (54 % против 66 % верных ответов в тесте знаний Artificial Analysis), так что малоизвестные детали стоит перепроверять. На уровне max она выдаёт больше текста, чем любая модель, которую измеряла Artificial Analysis, из-за чего max получается дорогим и медленным. Она не создаёт изображения, аудио и видео, а рискованные запросы по безопасности передаются старой Sonnet 5.

01

Что это на самом деле

Представьте офис, где работают два опытных человека. Первая — партнёр, которую зовут на встречу, когда дело необычное и ставки высоки. Второй — коллега, который разбирает недельную гору дел — сорок писем, три таблицы, презентацию к четвергу — быстро и аккуратно.

Второй человек большинству из нас нужен гораздо чаще первого. Claude Sonnet 5.5 — именно такой коллега.

Anthropic выпустила её 28 сентября 2026 года, через неделю после Claude Opus 5.5, — второй моделью семейства Claude 5.5. Она задумана как повседневное дополнение к Opus. По формулировке Anthropic, Opus создана для сложной работы, требующей тщательного суждения, а Sonnet 5.5 сильнее всего в чётко поставленных повседневных задачах, исправлении ошибок и создании аккуратно оформленных документов, презентаций и таблиц.

Насколько она близка к Opus?

Ближе, чем можно было бы ожидать, — по крайней мере, в независимых тестах.

У Artificial Analysis есть два теста, построенных вокруг готовой профессиональной работы, а не вопросов из викторины. В GDPval-AA v2.1 модели выдают реальные результаты — финансовую модель, юридическую записку, аналитическую справку, — и эти результаты сравниваются попарно, как шахматные партии. Sonnet 5.5 набрала 1844 Elo. У Opus 5.5 — 1846: разница слишком мала, чтобы иметь значение. В более новом AA-Briefcase, где проверяется длительная многошаговая интеллектуальная работа, у неё 1811 против 1822 у Opus.

Самая широкая независимая мера — Intelligence Index от Artificial Analysis, сводная оценка по набору сложных тестов. На уровне max Sonnet 5.5 набрала 56 баллов — впереди только Opus 5.5 с 58.

Для модели Sonnet это огромный шаг. Её предшественница Sonnet 5 набирала в GDPval-AA 1449. На практике это значит, что офисную работу, для которой раньше требовался флагман, теперь можно отдать более дешёвой и быстрой модели.

Где Opus по-прежнему впереди

Есть две области, где разрыв реален.

Факты. Тест AA-Omniscience от Artificial Analysis задаёт тысячи вопросов на знание фактов. Sonnet 5.5 верно ответила на 54 %, Opus 5.5 — на 66 %. Модель поменьше просто хранит меньше знаний. Но есть и светлая сторона: когда Sonnet 5.5 не знала ответа, она выдумывала его в 47 % случаев, а Opus 5.5 — в 59 %. Она знает меньше, зато охотнее в этом признаётся. И всё же, если нужна малоизвестная дата, имя или статистика, попросите её поискать в интернете или привести источник.

Суждение. Здесь Anthropic необычно откровенна. В ряде тестов Sonnet 5.5 на уровне max показывает результаты, сопоставимые с Opus 5.5. Но и во внутренних тестах Anthropic, и у внешних тестировщиков Opus 5.5 остаётся заметно сильнее в сложной, открытой работе, требующей длительного взвешенного суждения. Если у вопроса нет очевидных рамок — стратегическое решение, договор с необычными условиями, — это по-прежнему территория Opus.

В чём она хороша

Anthropic выделяет документы, пересказы, таблицы и презентации и отмечает у модели хорошее чувство дизайна: она может следовать шаблону слайдов так точно, что править почти ничего не приходится. Чтение графиков заметно улучшилось. В тесте Chartography от Anthropic, где модели считывают значения с графиков без вспомогательных инструментов, она набрала 61,6 %, тогда как Sonnet 5 — 15,6 %.

Кроме того, она быстрая. Anthropic утверждает, что ответ приходит более чем на 30 % быстрее, чем у Sonnet 5, и первые тестировщики это заметили: Zendesk сообщает, что обращения в поддержку обрабатывались на 20 % быстрее, а Box намерила скорость в 2,4 раза выше, чем у предыдущей версии.

Умеет она и управлять компьютером. В OSWorld 2.1, где модель кликает и печатает, пробираясь через настоящие настольные программы, Anthropic сообщает о 80,1 % с частичным зачётом — близко к 81,8 % у Opus 5.5.

Оставьте регулятор посередине

У Sonnet 5.5 пять уровней усилий: low, medium, high, xhigh и max. В приложениях Claude по умолчанию стоит medium. Вот что Artificial Analysis намерила на каждом уровне:

Усилия Intelligence Index Стоимость задачи
Low 36 0,41 $
Medium 41 0,59 $
High 47 1,08 $
Xhigh 52 2,74 $
Max 56 7,60 $

Дорого обходится именно последняя ступенька. На max Sonnet 5.5 писала около 193 000 выходных токенов на задачу — рекорд за всю историю замеров Artificial Analysis и примерно на 60 % больше, чем у Opus 5.5 на max. Для большинства пользователей приложения Claude это просто означает более долгое ожидание. Для разработчиков, которые платят за токены, — что Sonnet, выкрученная на максимум, уже не дешёвый вариант. Если задаче нужно столько размышлений, обычно она заслуживает Opus.

Честная оговорка

Никаких картинок. Claude хорошо читает скриншоты, графики и отсканированные PDF, но не создаёт изображения, аудио или видео. Если нужно одно приложение, которое ещё и рисует и разговаривает, ChatGPT и Gemini шире.

Цена токена — не цена задачи. Токены стоят столько же, сколько у Sonnet 5: 2 доллара за миллион входных и 10 долларов за миллион выходных. Anthropic утверждает, что типичные задачи обходятся до 30 % дешевле, потому что модель справляется за меньшее число шагов. Это верно на обычных настройках; на max, как видно из таблицы, счёт быстро растёт.

Некоторые запросы под защитой. Sonnet 5.5 — первая модель Sonnet со строгими защитными механизмами в области кибербезопасности, которые Anthropic применяет к своим самым сильным моделям. Рискованные запросы по безопасности заметно для пользователя передаются Sonnet 5. Почти никого это никогда не коснётся.

Кому она подойдёт

Если ваш день выглядит так… Берите Почему
Письма, пересказы, таблицы, презентации Claude Sonnet 5.5 Офисная работа почти на уровне Opus, быстро, на бесплатном тарифе
Решения с высокими ставками, малоизвестные факты, запутанные исследования Claude Opus 5.5 Больше знаний и заметно более сильное суждение
«Поработай в этой программе на моём компьютере и доведи дело до конца» GPT-6 Astra Более сильный и экономный агент для управления компьютером
Одно приложение для чата, картинок и голоса ChatGPT или Gemini Более широкий творческий набор инструментов

Вердикт для повседневной работы

Claude Sonnet 5.5 не заменит Opus на самых трудных вопросах, и Anthropic этого не скрывает. Но самые трудные вопросы — лишь малая часть большинства рабочих недель. Для всего остального она быстрая, толковая, доступна на бесплатном тарифе Claude и стоит так, что о цене можно не думать. Оставьте её на настройке по умолчанию, перепроверяйте малоизвестные факты и зовите Opus, когда ставки растут.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Близко к флагману в реальной работе: У Artificial Analysis есть два теста на готовые профессиональные результаты. Sonnet 5.5 набрала 1844 Elo в GDPval-AA v2.1 против 1846 у Opus 5.5 и 1811 в длительном AA-Briefcase против 1822. Для повседневной офисной работы они практически равны.
  • Вторая в самом широком независимом индексе: На уровне max она набирает 56 баллов в Intelligence Index от Artificial Analysis — впереди только Opus 5.5 с 58. Даже на повседневном уровне High у неё 47 баллов примерно за доллар за задачу.
  • Чаще говорит «не знаю»: В тесте знаний AA-Omniscience Sonnet 5.5 выдумала ответ в 47 % вопросов, на которые не смогла ответить верно, против 59 % у Opus 5.5: она охотнее признаёт неуверенность.
  • Создана для документов, презентаций и таблиц: По словам Anthropic, сильнее всего она в чётко поставленных повседневных задачах и аккуратно оформленных документах, и у неё хорошее чувство дизайна. Графики она читает намного лучше Sonnet 5: 61,6 % в тесте Chartography от Anthropic против 15,6 %.
  • Быстрая, доступная и дешевле для разработчиков: Ответ приходит более чем на 30 % быстрее, чем у Sonnet 5. Любой может пользоваться ею в веб- и мобильных приложениях Claude, в том числе на бесплатном тарифе, а разработчики платят 2/10 доллара за миллион токенов — вдвое меньше, чем за Opus 5.5, — через API Anthropic, AWS, Google Cloud и Microsoft Azure.

Честные ограничения

  • Меньше знаний в голове: В AA-Omniscience она верно ответила на 54 % вопросов на знание фактов, Opus 5.5 — на 66 %. Когда речь о малоизвестных именах, датах или цифрах, попросите её поискать в интернете или привести источник.
  • Уровень max того не стоит: Artificial Analysis намерила около 193 000 выходных токенов на задачу на max — это рекорд, — а стоимость задачи при переходе с xhigh на max вырастает почти втрое. Повседневной работе место на настройках по умолчанию.
  • В трудных случаях по-прежнему выигрывает Opus: Anthropic говорит, что Opus 5.5 остаётся заметно сильнее в сложной, открытой работе, требующей длительного взвешенного суждения: неоднозначный договор, стратегический вопрос без понятных рамок.
  • Ни картинок, ни голосовой студии: Claude читает изображения и графики, но не создаёт изображения, аудио или видео. ChatGPT и Gemini остаются более широкими универсальными наборами инструментов.
  • Часть запросов по безопасности перенаправляется: Sonnet 5.5 выходит с более строгими защитными механизмами Anthropic в области кибербезопасности, и рискованные задачи заметно для пользователя передаются Sonnet 5. Большинство людей этого никогда не заметит.
03

Результаты тестов

Artificial Analysis Intelligence Index — 56 (уровень max)

Независимая сводная оценка по набору сложных тестов, замер сентября 2026 года. На момент выхода впереди только Opus 5.5 (58). По уровням усилий: low 36, medium 41, high 47, xhigh 52, max 56.

GDPval-AA v2.1 — 1844 Elo

Реальные профессиональные результаты работы во многих профессиях, тест проводит Artificial Analysis. У Opus 5.5 — 1846, у Sonnet 5 — 1449.

AA-Briefcase v1.1 — 1811 Elo

Более новый тест Artificial Analysis на длительную многошаговую интеллектуальную работу. У Opus 5.5 — 1822, у Sonnet 5 — 1359.

AA-Omniscience — 54 % верных ответов, 47 % галлюцинаций

Независимый тест знаний. Opus 5.5 правильно отвечает на большее число вопросов (66 %), но чаще выдумывает, когда ошибается (59 %). Чем ниже доля галлюцинаций, тем лучше.

OSWorld 2.1 — 80,1 % (с частичным зачётом)

Данные Anthropic по работе с настоящим рабочим столом. У Opus 5.5 — 81,8 %, у Sonnet 5 — 57,0 % при таком же частичном зачёте.

Цена — 2 / 10 доллара за 1 млн токенов

Как у Sonnet 5 и вдвое меньше, чем у Opus 5.5. Artificial Analysis намерила стоимость задачи от 0,41 доллара на low до 7,60 доллара на max.

04

Вердикт

Claude Sonnet 5.5 — помощник, которым большинство людей может пользоваться каждый день, не думая о расходах: близко к Opus 5.5 в независимых тестах офисной работы, доступна на бесплатном тарифе Claude и вдвое дешевле в API. Она стоит ниже Opus 5.5, потому что знает заметно меньше фактов и, по признанию самой Anthropic, слабее справляется с открытыми вопросами, требующими суждения; позади GPT-6 Astra и Fable 5.1 она потому, что те лидируют в управлении компьютером и в долгих исследованиях. Для пересказов, таблиц, презентаций и отчётов это разумный выбор по умолчанию.

05

Часто задаваемые вопросы