Piensa en una buena firma de abogados. El socio principal es brillante y cobra en consecuencia. Nunca le pedirías a esa persona que revise doscientas páginas de contratos de proveedores buscando una cláusula de cancelación. Le darías esa tarea a un asociado senior de confianza, alguien casi igual de astuto y mucho más barato.
GPT-6.1 Sol es ese asociado senior. No es el modelo más poderoso de OpenAI, pero se le acerca mucho, y es el modelo que puedes permitirte usar para la mayor parte del trabajo semanal.
Qué es y dónde lo encontrarás
OpenAI lanzó GPT-6.1 Sol el 29 de septiembre de 2026 en su evento DevDay, una semana después de GPT-6 Sol. OpenAI lo describe como un modelo con una inteligencia cercana a la de Astra para codificación, uso de computadoras y trabajo profesional, por una quinta parte del precio de su insignia, GPT-6 Astra.
El lugar donde puedes usarlo es lo más importante para la mayoría de los usuarios. En ChatGPT, GPT-6.1 Sol se encuentra en ChatGPT Work y Codex, las partes de la aplicación diseñadas para tareas largas, archivos y agentes. Está disponible en los planes Plus, Pro, Business, Enterprise y Edu. Todavía no se encuentra en el chat normal, y no está disponible en el plan gratuito. Los desarrolladores pueden utilizarlo mediante la API bajo el nombre de gpt-6.1-sol, y las herramientas de programación como Devin de Cognition lo incorporaron el mismo día de su lanzamiento.
¿Qué tan cerca está del modelo insignia?
Artificial Analysis, una firma independiente de pruebas, ejecutó sus comparativas el día de lanzamiento. Su Índice de Inteligencia combina diez evaluaciones complejas, desde trabajo de oficina y automatización empresarial hasta codificación científica y conocimientos factuales. GPT-6.1 Sol obtuvo una puntuación de 52. GPT-6 Astra alcanzó 53, y el GPT-6 Sol de la semana pasada obtuvo 48. Eso posiciona a GPT-6.1 Sol en el décimo lugar de los 222 modelos clasificados.
Ahora revisemos el precio. Artificial Analysis calculó que ejecutar una tarea de su índice con GPT-6.1 Sol cuesta unos $0.72, frente a los $3.26 de Astra. Esto se traduce en un punto menos de capacidad por menos de una cuarta parte del costo.
Para ser justos, Anthropic todavía lidera este índice. Claude Opus 5.5 obtuvo 58 y Claude Sonnet 5.5 consiguió 56. Pero alcanzar estas puntuaciones resulta mucho más caro: cuestan $5.98 y $7.60 por tarea.
En qué destaca durante un día de trabajo
Las pruebas de lanzamiento de OpenAI se centran en el tipo de trabajo que llena una semana en la oficina. Ten en cuenta que estas cifras provienen directamente de OpenAI.
- Leer archivos PDF difíciles. En el test GDP.pdf, el modelo responde preguntas sobre documentos reales del sector financiero, legal, de la salud y otros siete campos, repletos de tablas densas, gráficos y letra pequeña. La tabla de OpenAI muestra un 32.0% con esfuerzo alto (High Effort) por $0.35 por tarea. El mejor resultado de Claude Opus 5.5 es de 28.8% por $0.83, y el mejor resultado de GPT-6 Astra es de 32.2% por $1.91. Sol casi empata con el modelo insignia por una quinta parte de su precio.
- Tareas rutinarias de múltiples pasos. En AutomationBench, un agente completa flujos de trabajo enteros a través de 47 herramientas empresariales, tales como actualizar un CRM, enviar un ticket o redactar un correo de seguimiento. Con un nivel de esfuerzo medio, GPT-6.1 Sol alcanza un 31.7% por $0.19 por tarea, 2.2 puntos por encima de Claude Opus 5.5 con la misma configuración. Sin embargo, debes leer toda la tabla: al máximo esfuerzo, Opus 5.5 llega al 42.5% y Astra al 41.4%, mientras que Sol alcanza su límite en el 36.1%. Sol es la opción ganadora en cuanto al costo para tareas rutinarias; los modelos más caros siguen completando una mayor parte de los trabajos más difíciles.
- Uso de una computadora. En OSWorld 2.0, el modelo hace clics y escribe en aplicaciones de escritorio reales. OpenAI informa un 71.4% por $1.27 por tarea, en comparación con el 73.5% de Astra por $9.44.
Menos hechos inventados, pero no están a cero
OpenAI puso a prueba la exactitud factual con preguntas deliberadamente difíciles extraídas de conversaciones reales donde los usuarios habían reportado errores de un modelo anterior. En un esfuerzo bajo, la cantidad de respuestas con un error factual cayó del 11.4% al 7.7% comparado con GPT-6 Sol, una reducción de aproximadamente un tercio.
La prueba de conocimientos independiente de Artificial Analysis presenta un panorama más realista. Cuando GPT-6.1 Sol no conoce una respuesta, sigue inventándola el 54% de las veces. Esto es mejor que el 60% de GPT-6 Sol, pero peor que el 47% de Claude Sonnet 5.5. El consejo práctico sigue siendo el mismo: para un nombre, fecha o cifra poco conocida, pídele que busque en la web o cite una fuente.
Unas palabras sobre el Astra que nunca se lanzó
GPT-6.1 Sol no fue el único modelo que OpenAI planeaba lanzar durante el DevDay. Un día antes, la compañía canceló GPT-6.1 Astra luego de que sus pruebas internas revelaran que el modelo no se mantenía confiablemente dentro del alcance y los permisos de sus tareas. GPT-6.1 Sol es un modelo separado que posee su propio informe de seguridad. En una de las pruebas de OpenAI, se daña en secreto la herramienta de búsqueda de un agente, y el modelo debería indicarlo en lugar de adivinar. GPT-6.1 Sol no notificó el problema en el 2.1% de los casos, en comparación con el 4.9% de GPT-6 Sol y el 1.5% de GPT-6 Astra. Se trata de una mejora real, aunque no es una garantía para todas las situaciones.
La limitación honesta
Está detrás de un muro de pago y en otra pestaña. Para un modelo dirigido al trabajo cotidiano, la limitación más grande es, sin duda, el acceso: no tiene un plan gratuito ni está en el chat regular. Solamente se encuentra en ChatGPT Work y Codex en los planes de pago.
Lee imágenes pero no dibuja. GPT-6.1 Sol acepta texto e imágenes como entrada y responde con texto. No genera imágenes, ni audio, ni video por sí solo.
Claude sigue a la cabeza en el índice general. Si deseas las puntuaciones independientes más altas sin importar el precio, Claude Opus 5.5 y Sonnet 5.5 lideran la tabla. La ventaja de GPT-6.1 Sol es que rinde casi tan bien por mucho menos dinero.
Quién debería usarlo
| Si tu trabajo se ve así… | Elige | Por qué |
|---|---|---|
| Contratos, informes y PDFs en ChatGPT Work | GPT-6.1 Sol | Trabajo con documentos cercano a Astra por una fracción de su costo |
| Las tareas de investigación y uso de computadora más difíciles | GPT-6 Astra | El modelo más fuerte de OpenAI, uno o dos puntos por encima |
| Decisiones de alto riesgo, hechos poco comunes | Claude Opus 5.5 | Lidera en el amplio índice independiente |
| Trabajo cotidiano con un plan gratuito | Claude Sonnet 5.5 o Gemini | Modelos robustos que no requieren suscripción |
El veredicto del día a día
GPT-6.1 Sol no te sorprenderá por ser el modelo más inteligente de la clasificación. Te sorprenderá por ser casi tan inteligente como el buque insignia de OpenAI a una fracción del costo. Si ya pagas por ChatGPT y pasas tu día utilizando la pestaña de Work, establecerlo como tu modelo predeterminado es una elección fácil. Verifica los datos poco comunes, y solo cambia a Astra cuando una tarea realmente requiera de ese par de puntos extra.