Puesto #6 Ecosistema Diario — Los Asistentes Líderes
xAI

Grok 4.5

Grok vuelve a la conversación de la frontera—no por ganar todos los trofeos, sino por hacer que el trabajo de agentes cercano a la frontera sea lo bastante económico para operar todo el día. Grok 4.5 combina un salto real en inteligencia con precios de API de $2/$6, alta velocidad, Grok Build, Cursor y Office. Es la opción práctica de ‘usar el buen modelo con más frecuencia’.

Actualizado 10 de julio de 2026 AgenticKnowledge WorkOffice
Ideal para

Grok vuelve a la conversación de la frontera—no por ganar todos los trofeos, sino por hacer que el trabajo de agentes cercano a la frontera sea lo bastante económico para operar todo el día. Grok 4.5 combina un salto real en inteligencia con precios de API de $2/$6, alta velocidad, Grok Build, Cursor y Office. Es la opción práctica de ‘usar el buen modelo con más frecuencia’.

Por qué gana

Artificial Analysis puntúa a Grok 4.5 con 54, cuarto en su Índice de Inteligencia; lo clasifica #3 como agente de programación en Grok Build, a la par de GPT-5.5 en Codex. $2/$6 por 1M de tokens de entrada/salida, $0.50 en entrada en caché, unos 91 tokens/s y un costo por tarea de $2.49 en el Índice de Agentes de Programación fortalecen su rendimiento por dólar. Grok Build es su hogar predeterminado, con integraciones en Cursor y Microsoft Office.

Ten en cuenta

Es un regreso ajustado por costo, no una corona incondicional de frontera. Grok 4.5 queda detrás de los líderes en varias pruebas de programación, aún no está disponible en la UE y Artificial Analysis detectó una tasa de alucinación mayor frente a Grok 4.3 a pesar de mejorar en precisión. Usa la ventaja económica para verificar, no para omitir la revisión.

01

Lo que realmente es

Durante un tiempo, el lugar de Grok en la jerarquía de modelos era fácil de describir: interesante, rápido, a veces atrevido, pero rara vez la herramienta que elegías cuando el trabajo era exigente. Grok 4.5 cambia esa frase. No regresa ganando todos los trofeos, sino con una calculadora en la mano.

Artificial Analysis sitúa al modelo en 54 en su Índice de Inteligencia, cuarto tras Fable 5, GPT-5.5 y Opus 4.8. Es cercano a la frontera en el sentido útil: sólido para trabajo de agentes serio, sin pretender que la montaña no tiene cima. Su punto fuerte es el costo asociado a esa inteligencia: $2 por millón de tokens de entrada y $6 por millón de salida, con $0.50 en aciertos de caché. Artificial Analysis calcula $0.31 por tarea del Índice de Inteligencia y mide 91.3 tokens por segundo. Es de los pocos lanzamientos donde “más barato” no significa usarlo solo para clasificar tickets.

El ecosistema también le da un lugar donde ser productivo. Grok 4.5 es predeterminado en Grok Build, está disponible en Cursor en todos los planes y accesible vía API de xAI. Además, xAI lo impulsa en Office: modelos financieros en Excel respaldados por investigación, diagramas en PowerPoint y borradores en Word. Esto lo convierte en un motor diario ideal para el trabajo de conocimiento: investigación, iteración de hojas de cálculo, análisis, diapositivas, borradores de producto y bucles de agentes que resultarían prohibitivos en un modelo insignia.

Las matemáticas de la API y las suscripciones de consumo son diferentes. SuperGrok parte de $30 al mes: algo más caro que el plan individual habitual de unos $20, pero sigue siendo un producto diario sumamente útil para quienes buscan Grok Build, límites más altos y la experiencia de usuario final en vez de una factura de API. SuperGrok Heavy tiene un precio de lista de $300 al mes, lo que representa un valor menor para el trabajo diario normal. Si la página de suscripción ofrece la promoción temporal de $99/mes para Heavy, ese es el punto dulce más interesante para un usuario de consumo que realmente aproveche la mayor capacidad y flujos de trabajo de agentes pesados todos los días. Es una promoción temporal, no el precio de lista permanente: consulta la página oficial de planes antes de asumirlo como fijo.

El valor de Grok 4.5 es simple: hace que el trabajo serio y repetido sea asequible. La investigación, la iteración de hojas de cálculo, el análisis, las presentaciones, las tareas en Cursor y los bucles largos de agentes se benefician cuando un modelo capaz es lo suficientemente económico como para dar otra pasada. No se trata de un modo especial o un caso de uso reducido; es la ventaja práctica de obtener un rendimiento cercano a la frontera sin tratar cada iteración como una compra de lujo.

Existe una trampa tentadora en todo esto: asumir que una buena curva de costos es prueba suficiente de fiabilidad como para dejar de revisar. Haz lo opuesto. Utiliza el ahorro para financiar otra prueba, otra verificación de fuentes u otra pasada del agente. Para una decisión única de altas consecuencias, los líderes en capacidad bruta mantienen el argumento más sólido, pero la inteligencia por dólar de Grok 4.5 es lo que hace asequible una verificación rigurosa.

El verdadero matiz está en la disponibilidad y calibración. Aún no está en la UE en su lanzamiento, y Artificial Analysis vio subir la precisión junto con las alucinaciones. Grok 4.5 no es el campeón universal; es la segunda opinión inteligente y rápida que puedes permitirte consultar repetidamente, una posición sumamente valiosa para el trabajo real.

02

Puntos fuertes y límites honestos

Puntos fuertes

  • Un regreso real a la frontera: Artificial Analysis otorga a Grok 4.5 una puntuación de 54 en su Índice de Inteligencia, situándose cuarto tras Fable 5, GPT-5.5 y Opus 4.8 en su análisis del 8 de julio. Un salto de 16 puntos sobre Grok 4.3 no es un cambio cosmético.
  • La economía para uso diario es excelente: La API cuesta $2 entrada / $6 salida por 1M de tokens, con entrada en caché a $0.50. Artificial Analysis calcula $0.31 por tarea del Índice de Inteligencia y lo sitúa en la frontera de Pareto de costo-rendimiento.
  • Suficientemente rápido para sentirse como un asistente, no una reunión: Artificial Analysis midió 91.3 tokens de salida por segundo en la API oficial. xAI informa aproximadamente la mitad de pasos que los líderes en tareas comparables; la velocidad no es inteligencia, pero decide si harás una décima iteración.
  • Un ecosistema de trabajo útil, no solo una pestaña de chat: Grok 4.5 es el predeterminado en Grok Build, funciona en Cursor en todos los planes y está en la API. xAI destaca integraciones con Microsoft Word, PowerPoint y Excel para hojas de cálculo respaldadas por investigación, presentaciones y documentos.
  • El trabajo de conocimiento por agentes tiene señal independiente: Artificial Analysis reporta el cuarto puesto en GDPval-AA v2 con 1543 Elo y un resultado top del 33% en τ³-Banking. Con ventana de 500K tokens, entrada de imágenes y razonamiento configurable, es mucho más que un autocompletador rápido.

Limitaciones honestas

  • Cercano a la frontera, no rey en capacidad bruta: En el mismo índice independiente, Grok 4.5 sigue a Fable 5, GPT-5.5 y Opus 4.8. Eso le otorga una sólida posición de valor aquí, no la afirmación ficticia de superar a todos los buques insignia.
  • La precisión aún requiere cinturón de seguridad: Artificial Analysis observó que la precisión AA-Omniscience subió del 35% al 52% frente a Grok 4.3, pero su tasa de alucinación también aumentó del 25% al 54%. Investigación, finanzas y documentos requieren verificación.
  • El acceso en la UE sigue ausente en el lanzamiento: xAI indica que Grok 4.5 aún no está disponible en la UE en sus productos o consola API, con disponibilidad prevista para mediados de julio. Un gran precio sirve de poco donde no puedes comprar el modelo.
  • La integración con Office es prometedora, no magia: Grok Build puede crear modelos complejos de Excel y documentos de Office, pero la lógica de las fórmulas, los datos de diapositivas y los permisos siguen siendo tu responsabilidad. Trata el primer borrador como el de un analista capaz, no como un informe firmado.
  • Las afirmaciones de eficiencia requieren validación por tarea: xAI reporta una eficiencia de tokens ~2× y menos pasos en tareas comparables. Son señales valiosas, pero tus prompts, herramientas, tasa de aciertos en caché y bucles de revisión deciden la factura real.
03

Resumen de Benchmarks

Índice de Inteligencia de Artificial Analysis — 54 (#4)

Resultado compuesto independiente situando a Grok 4.5 tras Fable 5, GPT-5.5 y Opus 4.8 en el análisis del 8 de julio de Artificial Analysis.

GDPval-AA v2 — 1543 Elo (#4)

Evaluación de trabajo profesional con agentes: Grok 4.5 se ubica entre Opus 4.8 y GLM-5.2 en la comparación citada.

τ³-Banking — 33%

Artificial Analysis reporta el mejor resultado en esta evaluación bancaria con agentes, superando el 31% de GPT-5.5.

Costo del Índice de Inteligencia — $0.31 por tarea

Cálculo de Artificial Analysis combinando uso de tokens y precios de API; respalda el caso de valor sin predecir la factura de cada carga de trabajo.

04

El Veredicto

Grok 4.5 es el modelo de uso diario del regreso: no el más capaz universalmente en cada gráfico, sino uno de los lugares más inteligentes para invertir un presupuesto de agentes. Tiene suficiente inteligencia independiente y credibilidad en trabajo de agentes para acompañar a los modelos de frontera, y gana el argumento práctico con velocidad, precios de $2/$6 e integraciones en Grok Build, Cursor y Office. Úsalo para investigación iterativa, documentos comerciales y trabajo habitual donde verificarás el resultado. Escala a los líderes de capacidad bruta para la rara tarea que realmente los requiera.

05

Preguntas frecuentes