Puesto #3 Ecosistema Diario — Los Asistentes Líderes
Anthropic

Claude Fable 5.1

Los mismos pesos que el exclusivo Mythos 5.1, pero con la capa de seguridad que la mayoría realmente obtiene. Es el modelo que Anthropic te dice que uses cuando Opus 5 a alto esfuerzo pierde en tu evaluación privada: codificación a largo plazo, investigación de varias horas, y documentos que deben mantener la coherencia.

ReasoningLong-ContextAgentic
Ideal para

Los mismos pesos que el exclusivo Mythos 5.1, pero con la capa de seguridad que la mayoría realmente obtiene. Es el modelo que Anthropic te dice que uses cuando Opus 5 a alto esfuerzo pierde en tu evaluación privada: codificación a largo plazo, investigación de varias horas, y documentos que deben mantener la coherencia.

Por qué gana

Índice de Inteligencia de Artificial Analysis 66 al máximo esfuerzo (el más alto medido en el lanzamiento). GDPval-AA v2 1853. Las lecturas de caché se redujeron un 75% a $0.25/MTok: el verdadero cambio de precio. Contexto de 1M, salida de 128k, pensamiento adaptativo siempre activado.

Ten en cuenta

El precio de lista sigue siendo $10/$50: 2× Opus 5. El esfuerzo máximo cuesta $3.76/tarea frente a Opus $2.34 porque escribe ~1.7× más tokens. El esfuerzo máximo puede sobre-editar. Covered Model (retención de 30 días). Sin generación de imágenes nativa.

01

Lo que realmente es

Si Opus 5 es el caballo de batalla confiable en el que confías para el 90% de tu trabajo diario de conocimiento, Fable 5.1 es el especialista que contratas para ese 10% restante que realmente te quita el sueño. Anthropic no está presentando una arquitectura completamente nueva aquí; Fable 5.1 es una actualización puntual que ajusta los clasificadores del Fable 5 original y, lo más importante, reduce drásticamente el costo de almacenar el contexto en caché. Comparte los mismos pesos que el altamente restringido Mythos 5.1, pero viene con la capa de seguridad que lo hace generalmente disponible para el público.

El salto en capacidad es real, pero se mide en resistencia en lugar de picos brutos. Fable 5.1 ocupó el primer lugar en el Índice de Inteligencia de Artificial Analysis en su lanzamiento con una puntuación de 66 al máximo esfuerzo, superando a Opus 5 (63) y GPT-5.6 Sol (61). También registró un dominante 1853 en GDPval-AA v2. Pero el cambio más significativo no está en la red neuronal: está en la página de precios. Si bien los costos base de los tokens siguen siendo de $10/$50, los precios de lectura de la caché se han reducido en un 75% a $0.25 por millón de tokens. Para los flujos de trabajo que dependen de una ventana de contexto caliente de 1M (como consultar bases de código masivas o sintetizar cientos de documentos), esto cambia fundamentalmente la economía de usar un modelo de razonamiento de frontera.

Sin embargo, usar Fable 5.1 no es gratis. El modelo cuenta con pensamiento adaptativo siempre activado, lo que significa que masticará un problema hasta que esté satisfecho. El resultado es un intenso apetito por los tokens; Fable 5.1 escribe aproximadamente 1.7 veces más tokens por tarea que su predecesor. En Artificial Analysis, el esfuerzo máximo cuesta $3.76 por tarea en comparación con los $2.34 de Opus 5. E irónicamente, más esfuerzo no siempre equivale a mejores resultados. La tarjeta del sistema revela que el esfuerzo máximo puede llevar a la “sobre-edición”: agregar documentación innecesaria, retoques de archivos de paso o trabajos complejos de CI donde una solución simple sería suficiente.

También existen las realidades operativas de un Covered Model. Fable 5.1 retiene tus datos durante 30 días a menos que tengas acuerdos de Salvaguardas Fronterizas Empresariales (EFS) o Retención de Datos Cero (ZDR). Además, los clasificadores de seguridad siguen siendo agresivos. Si bien puede identificar vulnerabilidades en tu código, se negará a escribir exploits, y las consultas complejas de investigación biológica desencadenarán silenciosamente un retroceso al modelo Opus. Y si accedes con frecuencia a la API con un contexto frío de 1M, esas lecturas frías de $10/MTok castigarán tus límites de uso rápidamente.

El propio consejo de enrutamiento de Anthropic es el mejor resumen del lugar de Fable 5.1 en el ecosistema: comienza con Opus 5. Pero cuando Opus falla en tus evaluaciones privadas —cuando te enfrentas a investigaciones de varias horas, tareas de codificación de horizonte largo o documentos complejos que deben mantener una coherencia estricta— Fable 5.1 es el respaldo más capaz del mundo. Es el modelo por el que pagas extra cuando hacerlo bien a la primera es lo único que importa.

02

Puntos fuertes y límites honestos

Puntos fuertes

  • Índice de Inteligencia AA 66: En su lanzamiento, Fable 5.1 ocupó el primer lugar en el Índice de Inteligencia de Artificial Analysis con una puntuación de 66 al máximo esfuerzo, superando a Opus 5 y GPT-5.6 Sol.
  • Descuento masivo en lectura de caché: Aunque el precio de lista sigue siendo alto, las lecturas de caché se reducen un 75% a $0.25/MTok. Para flujos de trabajo que dependen de un contexto caliente de 1M, esta reducción de precio cambia las reglas del juego.
  • Pensamiento adaptativo siempre activado: El modelo cuenta con pensamiento adaptativo siempre encendido, dándole el tiempo que necesita para razonar a través de problemas complejos de múltiples pasos que hacen tropezar a los modelos de una sola pasada.
  • Maestría a largo plazo: Con un contexto de 1 millón y límites de salida de 128k, maneja tareas de investigación de varias horas y procesamiento de documentos masivos mientras mantiene la coherencia mejor que cualquier competidor.
  • Líder en Inteligencia Compuesta: A pesar de la ventaja de Astra en categorías específicas como el uso de computadoras y matemáticas, Fable 5.1 retiene la corona en inteligencia compuesta y HLE (Evaluación a Nivel Humano).

Limitaciones honestas

  • Hambre de tokens y costos más altos: Fable 5.1 escribe ~1.7× más tokens que Fable 5. En Artificial Analysis, el esfuerzo máximo cuesta $3.76/tarea en comparación con los $2.34 de Opus 5. El descuento en caché ayuda, pero no es gratis.
  • Sobre-edición al máximo esfuerzo: Pensar más no siempre es mejor. La tarjeta del sistema revela que el esfuerzo ‘medio’ a menudo supera al ‘máximo’ en ingeniería de software porque el máximo agrega ediciones de archivos de paso, documentos adicionales y trabajos de CI innecesarios.
  • Restricciones del Covered Model: Fable 5.1 opera como un Covered Model con una retención de 30 días (a menos que haya EFS/ZDR). El Mythos 5.1 sin restricciones está bloqueado solo para acceso de confianza.
  • Los clasificadores de seguridad aún frenan el doble uso: El modelo puede encontrar vulnerabilidades pero no escribirá exploits. Si te adentras en la investigación biológica, el sistema de seguridad te enviará automáticamente a Opus.
  • Penalización por caché fría: Los límites de uso de Claude castigan a los usuarios que cargan con frecuencia un contexto frío de 1M. El precio completo de $10/MTok se aplica a las lecturas frías, consumiendo rápidamente los límites de uso.
03

Resumen de Benchmarks

Índice de Inteligencia de Artificial Analysis — 66 (Max)

El más alto medido en el lanzamiento, por delante de Opus 5 (63) y GPT-5.6 Sol (61).

GDPval-AA v2 — 1853

Supera a Fable 5 (1723) y Opus 5 (1824).

HLE tools — 65.0%

Lidera el grupo en Evaluación a Nivel Humano con herramientas, superando a Opus 5 (63.6%) y Astra (57.2%).

Signal65 PINNACLE — 7,898

276/280 trabajos de agentes completados; $2.46 por tarea correcta.

04

El Veredicto

Claude Fable 5.1 no es una nueva familia: es una actualización de precisión de Fable 5 que reduce drásticamente los costos de lectura de caché y ajusta los clasificadores. Si bien la propia regla de Anthropic es ‘comenzar con Opus 5’, Fable 5.1 es el especialista de peso pesado que llamas cuando Opus falla. La puntuación de 66 en el Índice de Inteligencia de Artificial Analysis demuestra su capacidad bruta, y el descuento del 75% en lectura de caché hace viables los flujos de trabajo de contexto largo. Pero el alto precio de lista, su hambre de tokens y el enrutamiento de seguridad agresivo significan que no es para charlas cotidianas. Úsalo cuando el trabajo exija investigación de varias horas, codificación compleja o generación coherente a lo largo de un contexto de 1 millón de tokens, y estés dispuesto a pagar la prima por el agente más inteligente de la sala.