Место #3 Повседневная экосистема — Ведущие ИИ-помощники
Anthropic

Claude Fable 5.1

Те же веса, что и у эксклюзивной Mythos 5.1, но с уровнем безопасности, который получает большинство пользователей. Это модель, которую Anthropic советует использовать, когда Opus 5 при высоких усилиях не справляется с вашими частными тестами — длительное программирование, многочасовые исследования и документы, которые должны оставаться связными.

ReasoningLong-ContextAgentic
Лучше всего для

Те же веса, что и у эксклюзивной Mythos 5.1, но с уровнем безопасности, который получает большинство пользователей. Это модель, которую Anthropic советует использовать, когда Opus 5 при высоких усилиях не справляется с вашими частными тестами — длительное программирование, многочасовые исследования и документы, которые должны оставаться связными.

Почему он побеждает

Индекс интеллекта Artificial Analysis 66 при максимальных усилиях (самый высокий показатель при запуске). Превосходит в GDPval-AA v2 с результатом 1853. Стоимость чтения из кэша снижена на 75% до $0.25/МТ — это настоящее изменение цен. Контекст 1М, 128к на выходе, постоянно активное адаптивное мышление.

Обратите внимание

Базовая цена остается $10/$50 — это в 2 раза больше Opus 5. Максимальное усилие стоит $3.76 за задачу против $2.34 у Opus, потому что он пишет в ~1.7 раза больше токенов. Максимальное усилие может привести к чрезмерному редактированию. Работает как Covered Model (хранение 30 дней). Нет встроенной генерации изображений.

01

Что это на самом деле

Если Opus 5 — это надежная рабочая лошадка, на которую вы полагаетесь в 90% вашей повседневной интеллектуальной работы, то Fable 5.1 — это специалист, которого вы нанимаете для тех 10%, которые действительно не дают вам спать по ночам. Anthropic не представляет здесь совершенно новую архитектуру; Fable 5.1 — это точечный релиз, который ужесточает классификаторы оригинального Fable 5 и, что более важно, радикально снижает стоимость кэширования контекста. Он использует те же веса, что и строго ограниченная Mythos 5.1, но поставляется с уровнем безопасности, который делает его общедоступным.

Скачок в возможностях реален, но измеряется он в выносливости, а не в пиковых показателях. Fable 5.1 занял первое место в индексе интеллекта Artificial Analysis при запуске с результатом 66 при максимальных усилиях, обойдя Opus 5 (63) и GPT-5.6 Sol (61). Он также показал доминирующий результат 1853 в GDPval-AA v2. Но самое значительное изменение находится не в нейронной сети — оно на странице с ценами. В то время как базовые затраты на токены остаются на премиальном уровне $10/$50, цены на чтение из кэша были снижены на 75% до $0.25 за миллион токенов. Для рабочих процессов, которые полагаются на горячее окно контекста в 1М — например, запросы к огромным кодовым базам или синтез сотен документов — это фундаментально меняет экономику использования передовой модели рассуждений.

Однако использование Fable 5.1 не обходится даром. Модель имеет постоянно активное адаптивное мышление, что означает, что она будет «жевать» проблему, пока не будет удовлетворена. В результате возникает острая жажда токенов; Fable 5.1 пишет примерно в 1.7 раза больше токенов на задачу, чем ее предшественница. В Artificial Analysis максимальное усилие обходится в $3.76 за задачу по сравнению с $2.34 у Opus 5. И, по иронии судьбы, больше усилий не всегда означает лучшие результаты. Системная карта показывает, что максимальное усилие может привести к «чрезмерному редактированию» — добавлению ненужной документации, внесению изменений в сторонние файлы или сложным заданиям CI там, где было бы достаточно простого исправления.

Существуют также операционные реалии Covered Model. Fable 5.1 хранит ваши данные в течение 30 дней, если у вас нет соглашений Enterprise Frontier Safeguards (EFS) или Zero Data Retention (ZDR). Кроме того, классификаторы безопасности остаются агрессивными. Хотя модель может выявить уязвимости в вашем коде, она откажется писать эксплойты, а сложные запросы в области биологии молча приведут к перенаправлению на модель Opus. И если вы часто обращаетесь к API с холодным контекстом в 1М, эти холодные чтения по $10/МТ быстро исчерпают ваши лимиты использования.

Собственные рекомендации Anthropic по маршрутизации лучше всего подводят итог месту Fable 5.1 в экосистеме: начните с Opus 5. Но когда Opus терпит неудачу на ваших частных тестах — когда вы сталкиваетесь с многочасовыми исследованиями, задачами кодирования с длинным горизонтом планирования или сложными документами, которые должны сохранять строгую связность — Fable 5.1 является самой способной резервной линией в мире. Это модель, за которую вы платите премию, когда сделать все правильно с первого раза — единственное, что имеет значение.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Индекс интеллекта AA 66: При запуске Fable 5.1 занял первое место в индексе интеллекта Artificial Analysis с результатом 66 при максимальных усилиях, обойдя Opus 5 и GPT-5.6 Sol.
  • Огромная скидка на чтение из кэша: В то время как базовая цена остается высокой, чтение из кэша снижено на 75% до $0.25/МТ. Для рабочих процессов, зависящих от горячего контекста в 1М, это снижение цен меняет правила игры.
  • Постоянно активное адаптивное мышление: Модель обладает постоянно активным адаптивным мышлением, что дает ей время для обдумывания сложных многошаговых проблем, на которых спотыкаются модели с однократным проходом.
  • Мастерство на длинных дистанциях: Имея миллионный контекст и лимит вывода в 128к, он справляется с многочасовыми исследовательскими задачами и массивной обработкой документов, сохраняя связность лучше, чем любой конкурент.
  • Лидер в композитном интеллекте: Несмотря на лидерство Astra в специфических категориях, таких как использование компьютера и математика, Fable 5.1 сохраняет корону композитного интеллекта и оценки человеческого уровня (HLE).

Честные ограничения

  • Жажда токенов и высокие затраты: Fable 5.1 пишет примерно в 1.7 раза больше токенов, чем Fable 5. На Artificial Analysis максимальное усилие обходится в $3.76 за задачу по сравнению с $2.34 у Opus 5. Скидка на кэш помогает, но это не бесплатно.
  • Чрезмерное редактирование при максимальном усилии: Больше размышлений не всегда означает лучше. Системная карта показывает, что «среднее» усилие часто превосходит «максимальное» в программной инженерии, потому что максимальное добавляет случайные изменения файлов, лишние документы и ненужные задания CI.
  • Ограничения Covered Model: Fable 5.1 работает как Covered Model с сохранением данных в течение 30 дней (если не используются EFS/ZDR). Неограниченная Mythos 5.1 остается доступной только для доверенного использования.
  • Классификаторы безопасности блокируют двойное назначение: Модель может находить уязвимости, но не будет писать эксплойты. Если вы погрузитесь в биологические исследования, система безопасности автоматически перенаправит вас на Opus.
  • Штраф за холодный кэш: Лимиты использования Claude наказывают пользователей, которые часто загружают холодный контекст в 1М. Полная цена $10/МТ применяется к холодным чтениям, быстро истощая лимиты использования.
03

Результаты тестов

Индекс интеллекта Artificial Analysis — 66 (Максимум)

Самый высокий показатель при запуске, опережая Opus 5 (63) и GPT-5.6 Sol (61).

GDPval-AA v2 — 1853

Превзошел Fable 5 (1723) и Opus 5 (1824).

HLE tools — 65.0%

Лидирует в оценке человеческого уровня (Human Level Evaluation) с инструментами, побеждая Opus 5 (63.6%) и Astra (57.2%).

Signal65 PINNACLE — 7,898

Выполнено 276/280 задач агента; $2.46 за каждую правильную задачу.

04

Вердикт

Claude Fable 5.1 — это не новое семейство, а точечное обновление Fable 5, которое радикально снижает затраты на чтение из кэша и ужесточает классификаторы. В то время как собственное правило Anthropic гласит «начните с Opus 5», Fable 5.1 — это специалист-тяжеловес, которого вы вызываете, когда Opus терпит неудачу. Оценка 66 в индексе интеллекта Artificial Analysis доказывает его чистые возможности, а скидка 75% на чтение из кэша делает рабочие процессы с длинным контекстом жизнеспособными. Но высокая базовая цена, жажда токенов и агрессивная маршрутизация безопасности означают, что он не предназначен для повседневных чатов. Используйте его, когда работа требует многочасовых исследований, сложного кодирования или связной генерации в миллионном контексте, и вы готовы платить премию за самого умного агента в комнате.