Muchos chatbots recuerdan a un becario brillante en un lunes caótico: rápidos, entusiastas y perfectamente capaces de entregar una hoja de cálculo impecable cuyo total final está, sin que nadie lo note, mal calculado. Claude Opus 5 se parece más al compañero que vuelve a comprobar las fórmulas antes de pulsar «Enviar».
Ese criterio lo lleva directamente al #1 cotidiano. La tabla de Anthropic le da 1861 Elo en GDPval-AA v2, una evaluación de tareas profesionales útiles. Fable 5 obtiene 1747, GPT-5.6 Sol 1736 y Opus 4.8 1593. Box informa un 8% de mejora general frente a 4.8, más en análisis y diligencia debida. Un cliente financiero vio nueve puntos más de precisión, menos pasos y 60% menos tiempo. Son informes iniciales, pero dibujan lo mismo: más cuidado y menos vueltas.
Más que una máquina de escribir culta
Opus 5 logra 70,6% en OSWorld 2.0, donde debe usar un ordenador de verdad. En AutomationBench alcanza 26,0%, cerca de una vez y media el siguiente resultado. Zapier informa de que Opus 5 completó de principio a fin un proceso para retener clientes: leyó los indicadores de salud de las cuentas, identificó a los clientes con riesgo de marcharse, avisó a los responsables de esas cuentas y preparó un resumen. Los modelos anteriores no lograban terminar toda la cadena.
El número más extraño es 30,2% en ARC-AGI-3. Mide aprender problemas desconocidos de forma interactiva, más parecido a descubrir las reglas de un juego que recordar un dato. Sol obtuvo 7,8%. Un benchmark no es un alma, pero sí sugiere talento cuando las instrucciones dejan de llevarlo de la mano.
Las pruebas independientes ya respaldan algo más que la dirección del lanzamiento. Artificial Analysis v4.1.1 da a Opus 5 con esfuerzo max aproximadamente 63, actualmente el primer lugar de su Intelligence Index. La escala exacta cambia a medida que evoluciona la evaluación, así que la versión y la fecha de consulta deben acompañar a la puntuación.
Por qué supera a Fable 5
Fable gana por poco en HLE sin herramientas, FrontierCode, el máximo CursorBench y una prueba legal. Si tu evaluación privada coincide, úsalo. Pero Fable cuesta $10/$50 por millón de tokens de entrada/salida. Opus 5 cuesta $5/$25, no exige retención general de datos y se espera que sus clasificadores intervengan con mucha menos frecuencia.
Piensa en Fable como un prototipo de carreras y en Opus 5 como el coche de carretera que es casi igual de rápido, cuesta la mitad de mantener y puede circular legalmente mucho más allá del circuito. Para el trabajo diario, el coche de carretera es la máquina más útil.
Por qué ChatGPT sigue siendo relevante
GPT-5.6 sigue siendo un sistema excelente. ChatGPT une Work, Codex, generación de imágenes, Sites, apps conectadas, navegador y uso del ordenador de escritorio en un ecosistema enorme. Claude no genera imágenes de forma nativa y los límites de sus planes pueden ser más estrechos. El ranking afirma que Opus 5 ofrece hoy la mejor mezcla de calidad de razonamiento, agencia profesional, precio y facilidad de despliegue; no que todos deban cancelar ChatGPT.
El banco de trabajo incluye 1M de tokens de contexto por defecto, 128k de salida máxima, visión para gráficos y documentos, PDF, archivos, memoria, búsqueda web, herramientas y uso del ordenador. El modelo de API es claude-opus-5, con soporte en la plataforma de Anthropic y las principales nubes. Fast mode funciona unas 2,5 veces más rápido al doble del precio base por token.
Hay matices. Los datos independientes siguen siendo jóvenes. Max puede ser verboso y xhigh tiene una latencia apreciable hasta el primer token. Web fetch de API y Priority Tier faltan en el lanzamiento. La práctica sensata es empezar más abajo, verificar el resultado y subir el esfuerzo solo cuando el coste de equivocarse sea mayor que el coste de pensar.
Opus 5 no es solo un Fable 5 más barato: es la mejor decisión cotidiana. Sustituye a Opus 4.8, gana suficientes pruebas importantes para desafiar a la frontera absoluta y vuelve asequible el criterio cuidadoso de la IA para un martes cualquiera, no solo para el proyecto que recibe un cheque en blanco.