Puesto #2 Ecosistema Diario — Los Asistentes Líderes
OpenAI

GPT-6 Astra

GPT-6 Astra es el nuevo buque insignia de OpenAI para la parte del trabajo que ocurre fuera del cuadro de chat. Maneja el navegador, hace clic en las aplicaciones de escritorio, lleva flujos de trabajo profesionales de varios pasos hasta el final y comprueba sus propios datos casi el doble de bien que GPT-5.6 Sol, dentro del mismo ecosistema de ChatGPT, Codex y API que ya conoces.

Actualizado 5 de septiembre de 2026 AgenticChatGPT WorkComputer Use
Ideal para

GPT-6 Astra es el nuevo buque insignia de OpenAI para la parte del trabajo que ocurre fuera del cuadro de chat. Maneja el navegador, hace clic en las aplicaciones de escritorio, lleva flujos de trabajo profesionales de varios pasos hasta el final y comprueba sus propios datos casi el doble de bien que GPT-5.6 Sol, dentro del mismo ecosistema de ChatGPT, Codex y API que ya conoces.

Por qué gana

Las pruebas independientes de Artificial Analysis otorgan a Astra 61,2 en su Intelligence Index —empate estadístico con Sol—, mientras que las tablas de lanzamiento muestran un 72,6% en OSWorld 2.0 (uso de ordenador) en aproximadamente la mitad del tiempo de Sol, un 59,3% en Agents' Last Exam, un 62,7% en el arnés estándar de ARC-AGI-3 (99,9% solo con el adaptador propio de OpenAI), un 64,6% en Terminal-Bench Science y alucinaciones aproximadamente reducidas a la mitad con mayor precisión. Disponible desde el primer día en ChatGPT, Codex, la API, Azure y Bedrock.

Ten en cuenta

Es una mejora de especialista, no un récord de CI. Las puntuaciones independientes de trabajo del conocimiento (GDPval-AA) bajaron respecto a Sol, Claude Fable 5.1 sigue liderando los compuestos de inteligencia general, y el precio de la API es 2,5 veces el de Sol, a 10/50 dólares por millón de tokens con una lectura de caché de 1 dólar. Las respuestas breves de Astra perdieron terreno en pruebas de derecho, finanzas y presentaciones, y el despliegue del primer día dejó a algunos usuarios de pago fuera.

01

Lo que realmente es

Cada lanzamiento insignia llega con el mismo cartel: el modelo más inteligente jamás construido. El cartel de GPT-6 Astra es distinto, y más útil. Dice: este toma el teclado. Astra es el nuevo buque insignia de OpenAI para el trabajo que ocurre fuera del cuadro de chat: operar un navegador, hacer clic en aplicaciones de escritorio, llevar un flujo profesional de varios pasos hasta el final, y comprobar sus propios datos mucho mejor mientras lo hace.

La historia medida coincide con el discurso. En OSWorld 2.0, la prueba de operaciones de escritorio, Astra logra un 72,6% y termina en unos 40 minutos donde GPT-5.6 Sol necesitó unos 75; Opus 5 queda en 70,2%. En Agents’ Last Exam, una evaluación de flujos profesionales de largo alcance en 55 campos, alcanza un 59,3%. Y el seguimiento de factualidad de Artificial Analysis muestra la tasa de alucinaciones aproximadamente reducida a la mitad frente a Sol, con mayor precisión. Menos errores seguros de sí mismos y trabajo terminado más rápido: esa es la mejora que se siente desde la primera semana.

Va el asterisco honesto. En el Intelligence Index de Artificial Analysis, Astra puntúa 61,2 —empate estadístico con el 60,9 de Sol—, mientras Claude Fable 5.1 lidera con 65,7. En trabajo del conocimiento GDPval-AA v2, los ~1629 de Astra quedan tras Opus 5 (1824) y Fable 5.1 (1853), y tras Sol. Si tu día es due diligence, informes y juicio, el nuevo insignia no es automáticamente la mejor herramienta; es una herramienta distinta. Y el precio de la API —10/50 dólares por millón de tokens, 2,5 veces Sol, con lecturas de caché a 1 dólar— deja esa diferencia bastante clara.

Encamina el trabajo

Tarea Encamínala a Por qué
«Hazlo en mi ordenador»: navegador, archivos, apps de escritorio, hasta el final Astra El mejor uso del ordenador medido, casi el doble de rápido por tarea
Trabajo del conocimiento con mucho juicio, due diligence, documentos largos Opus 5 Mayor GDPval a la cuarta parte del precio de API
El razonamiento puro más difícil y el contexto largo y desordenado Fable 5 / Fable 5.1 Lidera los compuestos independientes de inteligencia
Volumen, borradores de rutina, la cinta transportadora diaria Sol / Terra / Luna Siguen disponibles, siguen siendo los asientos más baratos

La pega honesta

Astra es parco por temperamento. Ese estilo de velocidad gana evaluaciones de programación y pierde rúbricas de derecho, finanzas e impuestos que premian listar cada paso; su acabado de presentación bajó respecto a Sol aunque la calidad analítica subió. El despliegue del primer día fue caótico: los usuarios de pago se encontraron con una lotería de acceso y las cuentas Enterprise llegaron con Astra desactivado por defecto. No hay generación nativa de imágenes ni salida de audio o vídeo. Y sus capacidades ciber mucho más fuertes (100% en ExploitBench, con 0-days desconocidos descubiertos durante la evaluación) vienen con salvaguardas más estrictas que pueden frenar trabajo legítimo adyacente a la seguridad.

Así que el hábito ganador: Astra para el asiento del conductor, Opus para el juicio, Fable para el pensamiento duro, Sol para la cinta transportadora. OpenAI no ha construido un cerebro más grande; ha construido mejores manos. Para mucho trabajo real, esa es la mejora que importa.

02

Puntos fuertes y límites honestos

Puntos fuertes

  • Uso del ordenador que termina el trabajo: Astra logra un 72,6% en OSWorld 2.0 frente al 65,7% de Sol y el 70,2% de Opus 5, y completa el conjunto de tareas en unos 40 minutos donde Sol necesitó unos 75. En ChatGPT Work eso se convierte en un agente que navega, hace clic, escribe y mueve archivos hasta que el trabajo está hecho, contigo como responsable de aprobar.
  • Aproximadamente la mitad de alucinaciones: El seguimiento de factualidad de Artificial Analysis muestra que la tasa de alucinaciones de Astra se reduce a cerca de la mitad de la de Sol, mientras la precisión subió unos cuatro puntos. Para el trabajo profesional, menos errores seguros de sí mismos vale más que otro punto de examen.
  • Un colega científico en serio: Astra puntúa 64,6% en Terminal-Bench Science —frente al 52,6% de Fable 5.1 y el 22,4% de Sol— y alrededor de 97,6% en FrontierMath Tier 4. Durante la evaluación incluso produjo demostraciones de dos de los 68 problemas abiertos de Erdős; un detalle puramente experimental, no una promesa de producto.
  • Músculos para problemas nuevos: En el arnés estándar de ARC-AGI-3 Astra alcanza un 62,7%, aproximadamente el doble del 30,2% de Opus 5. La cifra de 99,9% que quizá hayas visto requiere el adaptador y la compactación del propio OpenAI; considera el 62,7% como el número honesto y comparable.
  • Continuidad del ecosistema: Astra entra desde el primer día en ChatGPT Work, Codex, la aplicación de escritorio y Sites, con el identificador de API gpt-6-astra, listados en Azure y Bedrock, Zero Data Retention para trabajo API elegible, un contexto de unos 1,05 millones de tokens y soporte desde el día uno en herramientas como Devin.

Limitaciones honestas

  • No es un salto de inteligencia general: Artificial Analysis sitúa a Astra en 61,2 frente al 60,9 de Sol —un empate—, mientras Claude Fable 5.1 lidera con 65,7. En trabajo del conocimiento GDPval-AA v2, los ~1629 de Astra quedan por detrás de Opus 5 (1824) y Fable 5.1 (1853), y por detrás de Sol. Si tu día son informes, due diligence y juicio, Astra no es automáticamente la mejor compra.
  • Economía premium: La API cuesta 10/50 dólares por millón de tokens de entrada/salida —2,5 veces Sol—, con lectura de caché a 1 dólar (Fable 5.1 cobra 0,25), escritura de caché a 12,50, precio de entrada duplicado para prompts de más de 272k tokens y precio doble en modo rápido. Artificial Analysis calcula que Astra cuesta aproximadamente un 75% más por tarea del índice de inteligencia que Sol, pese a usar cerca de un 10% menos de tokens.
  • Fricción de estilo y de acceso: Astra es parco, y por eso pierde puntos de rúbrica en evaluaciones de derecho, finanzas e impuestos; su acabado de presentación bajó respecto a Sol aunque la calidad del análisis subió. El despliegue del primer día fue caótico —el acceso Enterprise se entregó desactivado por defecto— y no hay generación nativa de imágenes ni salida de audio o vídeo. Las salvaguardas cibernéticas más fuertes frenan algo del trabajo legítimo adyacente a la seguridad, y las propias tablas de OpenAI se movieron un poco tras publicarse: trata cada celda como ±1–2 puntos.
03

Resumen de Benchmarks

OSWorld 2.0 — Astra 72,6% en ~40 min

Tabla de uso de ordenador de OpenAI, frente a Sol con 65,7% (~75 min) y Opus 5 con 70,2%. Medido en un conjunto parcial de tareas sin conexión: una señal direccional fuerte, no una garantía para tus aplicaciones concretas.

Artificial Analysis Intelligence Index — 61,2

Compuesto independiente: empatado con GPT-5.6 Sol en 60,9 y por detrás de Claude Fable 5.1 en 65,7. El titular honesto es «con mayor capacidad de acción» (más agéntico), no «más inteligente».

Seguimiento de factualidad de AA — alucinaciones casi reducidas a la mitad

Medición independiente que muestra cerca de la mitad de la tasa de alucinaciones de Sol con unos cuatro puntos más de precisión: el cambio de fiabilidad que los profesionales sí notan.

ARC-AGI-3 — 62,7% estándar / 99,9% con adaptador del proveedor

Resolución de problemas interactivos novedosos. El 62,7% es la cifra comparable del arnés estándar (Opus 5: 30,2%); el 99,9% incluye el arnés Responses y la compactación de OpenAI y debería llevar siempre esa nota al pie.

Precios de API — 10/50 $ · lectura de caché 1 $ · escritura 12,50 $

Por 1M de tokens de entrada/salida, más 2x entrada / 1,5x salida para prompts de más de 272k tokens y 2x en modo rápido. Compara el coste por tarea terminada y el comportamiento de la caché, no los precios de portada.

04

El Veredicto

GPT-6 Astra toma el puesto nº 2 de uso diario que ocupaba GPT-5.6 porque es el agente de uso de ordenador y de ciencia más capaz dentro de la plataforma de consumo más amplia: ChatGPT Work, Codex, escritorio, Sites y la API. Opus 5 conserva el nº 1 en juicio por dólar para trabajo del conocimiento puro, y Fable 5 sigue siendo el especialista en inteligencia. Elige Astra cuando el trabajo sea «hazlo en mi ordenador y termínalo»; elige Opus 5 cuando lo que se entrega es juicio; conserva Sol, Terra y Luna para el volumen a los precios de siempre.

05

Preguntas frecuentes