Puesto #4 Ecosistema Diario — Los Asistentes Líderes
Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 es el asistente para la semana laboral de siempre: resumir documentos, montar hojas de cálculo y presentaciones, redactar informes. En las pruebas independientes de trabajo de oficina queda a uno o dos puntos de Opus 5.5, está disponible en el plan gratuito de Claude y sus tokens de API cuestan la mitad. Eso sí, Opus sabe más datos y resuelve mejor los problemas realmente enrevesados.

Actualizado 29 de septiembre de 2026 Knowledge WorkFreemium1M Context
Ideal para

Claude Sonnet 5.5 es el asistente para la semana laboral de siempre: resumir documentos, montar hojas de cálculo y presentaciones, redactar informes. En las pruebas independientes de trabajo de oficina queda a uno o dos puntos de Opus 5.5, está disponible en el plan gratuito de Claude y sus tokens de API cuestan la mitad. Eso sí, Opus sabe más datos y resuelve mejor los problemas realmente enrevesados.

Por qué gana

Obtiene 56 puntos en el Intelligence Index independiente de Artificial Analysis con esfuerzo max, dos por detrás de Opus 5.5 (58). Artificial Analysis también midió 1844 Elo en GDPval-AA v2.1 (Opus 5.5: 1846) y 1811 en AA-Briefcase (Opus 5.5: 1822). Cuando no sabe una respuesta, se la inventa con menos frecuencia que Opus 5.5. Los tokens de API cuestan 2/10 dólares y la respuesta llega más de un 30 % más rápido que con Sonnet 5.

Ten en cuenta

Sabe menos datos que Opus 5.5 (54 % frente a 66 % de aciertos en la prueba de conocimientos de Artificial Analysis), así que conviene comprobar los detalles poco conocidos. Con esfuerzo max genera más texto que cualquier modelo que Artificial Analysis haya medido, lo que hace max caro y lento. No genera imágenes, audio ni vídeo, y las peticiones de seguridad de mayor riesgo pasan al antiguo Sonnet 5.

01

Lo que realmente es

Imagina una oficina con dos profesionales veteranos. Una es la socia a la que llamas a la reunión cuando el caso es inusual y hay mucho en juego. El otro es el compañero que despacha el montón de la semana —cuarenta correos, tres hojas de cálculo, una presentación para el jueves— rápido y bien.

La mayoría de nosotros necesita a la segunda persona mucho más a menudo que a la primera. Claude Sonnet 5.5 es ese compañero.

Anthropic lo lanzó el 28 de septiembre de 2026, una semana después de Claude Opus 5.5, como segundo modelo de la familia Claude 5.5. Está pensado como el complemento cotidiano de Opus. En palabras de Anthropic, Opus está hecho para el trabajo complejo que exige un criterio cuidadoso, mientras que Sonnet 5.5 destaca en tareas cotidianas bien acotadas, en corregir errores y en crear documentos, presentaciones y hojas de cálculo cuidados.

¿Cuánto se acerca a Opus?

Más de lo que cabría esperar, al menos en las pruebas independientes.

Artificial Analysis tiene dos pruebas centradas en trabajo profesional terminado, no en preguntas de examen. En GDPval-AA v2.1, los modelos producen entregables reales —un modelo financiero, un memorando jurídico, un informe— y los resultados se comparan cara a cara, como partidas de ajedrez. Sonnet 5.5 obtuvo 1844 Elo. Opus 5.5 obtuvo 1846, una diferencia demasiado pequeña para importar. En la más reciente AA-Briefcase, que evalúa trabajo intelectual más largo y de varios pasos, logró 1811 frente a los 1822 de Opus.

La medida independiente más amplia es el Intelligence Index de Artificial Analysis, una puntuación compuesta a partir de evaluaciones exigentes. Con esfuerzo max, Sonnet 5.5 obtuvo 56, solo por detrás de Opus 5.5 con 58.

Para un Sonnet es un salto enorme. Su predecesor, Sonnet 5, obtuvo 1449 en GDPval-AA. En la práctica, el trabajo de oficina que antes necesitaba el modelo insignia puede pasar ahora al modelo más barato y rápido.

Dónde sigue ganando Opus

Hay dos terrenos en los que la diferencia es real.

Los datos. La prueba AA-Omniscience de Artificial Analysis plantea miles de preguntas sobre hechos. Sonnet 5.5 acertó el 54 %; Opus 5.5, el 66 %. Un modelo más pequeño simplemente guarda menos conocimiento. Pero hay un lado bueno: cuando Sonnet 5.5 no sabía una respuesta, se la inventó el 47 % de las veces, frente al 59 % de Opus 5.5. Sabe menos, pero está más dispuesto a reconocerlo. Aun así, para una fecha poco conocida, un nombre o una estadística, pídele que busque en la web o que cite una fuente.

El criterio. Aquí Anthropic es inusualmente directa. En varias pruebas, Sonnet 5.5 con esfuerzo max rinde de forma comparable a Opus 5.5. Pero en las pruebas internas de Anthropic y en las de evaluadores externos, Opus 5.5 sigue siendo claramente más fuerte en el trabajo complejo y abierto que exige un criterio sostenido. Si una pregunta no tiene un marco evidente —una decisión estratégica, un contrato con cláusulas poco habituales—, sigue siendo terreno de Opus.

En qué es bueno

Anthropic destaca los documentos, los resúmenes, las hojas de cálculo y las presentaciones, y dice que el modelo tiene buen ojo para el diseño: puede seguir una plantilla de diapositivas con tanta precisión que apenas hace falta retocarla. Su lectura de gráficos ha mejorado muchísimo. En la prueba Chartography de Anthropic, que pide leer valores de gráficos sin herramientas, obtuvo un 61,6 %, frente al 15,6 % de Sonnet 5.

También es rápido. Anthropic dice que la respuesta llega más de un 30 % más rápido que con Sonnet 5, y los primeros evaluadores lo notaron: Zendesk cuenta que las incidencias de soporte se procesaron un 20 % más rápido, y Box midió 2,4 veces la velocidad de la versión anterior.

Además puede manejar un ordenador. En OSWorld 2.1, donde un modelo hace clic y escribe para abrirse paso por aplicaciones de escritorio reales, Anthropic informa de un 80,1 % con puntuación parcial, cerca del 81,8 % de Opus 5.5.

Deja el control a media altura

Sonnet 5.5 tiene cinco niveles de esfuerzo: low, medium, high, xhigh y max. Las aplicaciones de Claude usan medium por defecto. Esto es lo que midió Artificial Analysis en cada nivel:

Esfuerzo Intelligence Index Coste por tarea
Low 36 0,41 $
Medium 41 0,59 $
High 47 1,08 $
Xhigh 52 2,74 $
Max 56 7,60 $

El último escalón es el caro. En max, Sonnet 5.5 escribió unos 193.000 tokens de salida por tarea, la cifra más alta que Artificial Analysis ha medido nunca y alrededor de un 60 % más que Opus 5.5 en max. Para la mayoría de la gente en la aplicación de Claude, eso significa simplemente esperar más. Para los desarrolladores que pagan por token, significa que un Sonnet al máximo ya no es la opción barata. Si una tarea necesita tanto razonamiento, normalmente merece Opus.

La pega honesta

Sin imágenes. Claude lee bien capturas de pantalla, gráficos y PDF escaneados, pero no genera imágenes, audio ni vídeo. Si quieres una aplicación que además dibuje y hable, ChatGPT y Gemini son más completos.

El precio por token no es el precio por tarea. Los tokens cuestan lo mismo que en Sonnet 5: 2 dólares por millón de entrada y 10 dólares por millón de salida. Anthropic dice que las tareas típicas cuestan hasta un 30 % menos porque el modelo termina en menos pasos. Eso vale con los ajustes normales; en max, como muestra la tabla, la factura sube deprisa.

Algunas peticiones están protegidas. Sonnet 5.5 es el primer Sonnet que llega con las salvaguardas de ciberseguridad más estrictas que Anthropic aplica a sus modelos más potentes. Las peticiones de seguridad de mayor riesgo pasan visiblemente a Sonnet 5. Para casi todo el mundo, esto nunca llega a importar.

Para quién es

Si tu día se parece a… Usa Por qué
Correos, resúmenes, hojas de cálculo, presentaciones Claude Sonnet 5.5 Trabajo de oficina casi al nivel de Opus, rápido y en el plan gratuito
Decisiones de alto riesgo, datos poco conocidos, investigación enrevesada Claude Opus 5.5 Más conocimiento y un criterio claramente más fuerte
«Maneja este programa en mi ordenador y termina el trabajo» GPT-6 Astra Agente de uso del ordenador más fuerte y económico
Una sola aplicación para chat, imágenes y voz ChatGPT o Gemini Caja de herramientas creativa más amplia

El veredicto para el día a día

Claude Sonnet 5.5 no sustituirá a Opus en las preguntas más difíciles, y Anthropic no finge lo contrario. Pero las preguntas más difíciles son una parte pequeña de la mayoría de las semanas. Para todo lo demás, es rápido, capaz, está en el plan gratuito de Claude y tiene un precio que te permite no pensar en ello. Déjalo en el ajuste predeterminado, comprueba los datos poco conocidos y llama a Opus cuando lo que está en juego sube.

02

Puntos fuertes y límites honestos

Puntos fuertes

  • Cerca del modelo insignia en trabajo real: Artificial Analysis tiene dos pruebas basadas en entregables profesionales terminados. Sonnet 5.5 obtuvo 1844 Elo en GDPval-AA v2.1 frente a 1846 de Opus 5.5, y 1811 en AA-Briefcase, de largo recorrido, frente a 1822. Para el trabajo de oficina diario, los dos están prácticamente empatados.
  • Segundo en el índice independiente más amplio: Con esfuerzo max obtiene 56 puntos en el Intelligence Index de Artificial Analysis, solo por detrás de Opus 5.5 con 58. Incluso con el esfuerzo High de uso diario llega a 47 por alrededor de un dólar por tarea.
  • Dice «no lo sé» más a menudo: En la prueba de conocimientos AA-Omniscience, Sonnet 5.5 se inventó la respuesta en el 47 % de las preguntas que no supo contestar bien, frente al 59 % de Opus 5.5: admite la duda con más facilidad.
  • Hecho para documentos, presentaciones y hojas de cálculo: Anthropic dice que donde más destaca es en tareas cotidianas bien acotadas y documentos cuidados, y que tiene buen ojo para el diseño. Además lee gráficos mucho mejor que Sonnet 5: 61,6 % en la prueba Chartography de Anthropic frente a 15,6 %.
  • Rápido, accesible y más barato para desarrollar: La respuesta llega más de un 30 % más rápido que con Sonnet 5. Cualquiera puede usarlo en las aplicaciones web y móviles de Claude, incluido el plan gratuito, y los desarrolladores pagan 2/10 dólares por millón de tokens —la mitad que Opus 5.5— en la API de Anthropic, AWS, Google Cloud y Microsoft Azure.

Limitaciones honestas

  • Menos datos en la cabeza: En AA-Omniscience acertó el 54 % de las preguntas de conocimiento, frente al 66 % de Opus 5.5. Para nombres, fechas o cifras poco conocidos, pídele que busque en la web o que cite una fuente.
  • El esfuerzo max no compensa: Artificial Analysis midió unos 193.000 tokens de salida por tarea en max, la cifra más alta registrada, y el coste por tarea casi se triplica al pasar de xhigh a max. El trabajo diario va con los ajustes predeterminados.
  • Opus sigue ganando en los casos difíciles: Anthropic afirma que Opus 5.5 sigue siendo claramente más fuerte en el trabajo complejo y abierto que exige un criterio sostenido: el contrato ambiguo, la pregunta estratégica sin un marco claro.
  • Ni imágenes ni estudio de voz: Claude lee imágenes y gráficos, pero no crea imágenes, audio ni vídeo. ChatGPT y Gemini siguen siendo cajas de herramientas más completas.
  • Algunas peticiones de seguridad se desvían: Sonnet 5.5 llega con las salvaguardas de ciberseguridad más estrictas de Anthropic, y las tareas de seguridad de mayor riesgo pasan visiblemente a Sonnet 5. La mayoría de la gente nunca lo notará.
03

Resumen de Benchmarks

Artificial Analysis Intelligence Index — 56 (esfuerzo max)

Puntuación compuesta independiente a partir de evaluaciones exigentes, medida en septiembre de 2026. En el lanzamiento, solo por detrás de Opus 5.5 (58). Por esfuerzo: low 36, medium 41, high 47, xhigh 52, max 56.

GDPval-AA v2.1 — 1844 Elo

Entregables profesionales reales de muchas ocupaciones, evaluados por Artificial Analysis. Opus 5.5 obtiene 1846 y Sonnet 5, 1449.

AA-Briefcase v1.1 — 1811 Elo

La prueba más reciente de Artificial Analysis sobre trabajo intelectual largo y de varios pasos. Opus 5.5 obtiene 1822 y Sonnet 5, 1359.

AA-Omniscience — 54 % de aciertos, 47 % de tasa de alucinación

Prueba de conocimientos independiente. Opus 5.5 acierta más preguntas (66 %), pero se inventa la respuesta más a menudo cuando falla (59 %). Una tasa de alucinación más baja es mejor.

OSWorld 2.1 — 80,1 % (puntuación parcial)

Cifra de Anthropic para el manejo de un escritorio real. Opus 5.5 obtiene un 81,8 % y Sonnet 5 un 57,0 % con la misma puntuación parcial.

Precio — 2 / 10 dólares por millón de tokens

Igual que Sonnet 5 y la mitad que Opus 5.5. Artificial Analysis midió un coste por tarea que va de 0,41 dólares en low a 7,60 dólares en max.

04

El Veredicto

Claude Sonnet 5.5 es el asistente que la mayoría de la gente puede usar a diario sin pensar en el coste: cerca de Opus 5.5 en las pruebas independientes de trabajo de oficina, disponible en el plan gratuito de Claude y a la mitad del precio de la API. Queda por debajo de Opus 5.5 porque sabe bastantes menos datos y, según reconoce la propia Anthropic, maneja peor el criterio en problemas abiertos; queda detrás de GPT-6 Astra y Fable 5.1 porque estos lideran en el manejo del ordenador y en la investigación larga. Para resúmenes, hojas de cálculo, presentaciones e informes, es la opción sensata por defecto.

05

Preguntas frecuentes