
¿Qué es Grok 4.5? El buque insignia V9 que vendió economía de tokens en lugar de puntuaciones máximas
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok 4.5 es un modelo de razonamiento de mezcla de expertos de 1,5 billones de parámetros del proveedor —la empresa que ahora distribuye y comercializa bajo la marca SpaceXAI—, publicado el 8 de julio de 2026. Acepta texto e imágenes como entrada, devuelve texto, cuenta con una ventana de contexto de 500.000 tokens y tiene un precio de 2,00 USD por millón de tokens de entrada y 6,00 USD por millón de tokens de salida. Fue el modelo que puso «tokens por tarea finalizada» en la portada de una diapositiva de lanzamiento, y es el modelo sobre el que el laboratorio ha construido desde entonces dos nuevos buques insignia.
Esa última cláusula es la razón principal por la que esta página necesita escribirse. Busca "Grok 4.5" y obtienes cobertura de lanzamiento de julio: la alianza con Cursor, la cita "Opus-class", la afirmación de 80 tokens por segundo. Lo que no obtienes es una respuesta directa a la pregunta que un desarrollador realmente tiene a finales de septiembre, que es si Grok 4.5 todavía vale la pena para integrarlo en algo cuando Grok 4.6 y Grok 4.7 existen al mismo precio de lista. Así que esta página es una entrada de referencia, no una pieza de noticias: qué es el modelo, dónde se ubica, qué hace bien de forma medible, qué hace mal de forma medible y quién debería elegir otra cosa. Nada aquí está planteado como un lanzamiento, porque no lo es.
Sobre las fuentes, dado que importan más de lo habitual en una página como esta: cada cifra a continuación está etiquetada según su procedencia. Las cifras que xAI publicó sobre su propio modelo están marcadas como reportadas por el proveedor. Las cifras de Artificial Analysis son mediciones independientes, leídas directamente de la página del modelo el 23 de septiembre de 2026. Cuando una cifra no pudo confirmarse en una fuente primaria, la página lo indica en lugar de estimarla.
Dónde se sitúa Grok 4.5 dentro de su propia familia — y no está en la cima
El error más común, con diferencia, en la cobertura de Grok 4.5 es tratarlo como el buque insignia. Lo fue durante unas cinco semanas. Desde entonces, xAI lanzó Grok 4.6 el 12 de agosto de 2026 y Grok 4.7 a principios de septiembre, y ambos siguen teniendo un precio de $2.00 y $6.00 por millón de tokens. Grok 4.5 ahora está en medio de la gama: más capaz que el nivel económico, dos generaciones por detrás de la vanguardia y —esta es la parte que importa— el único modelo de la línea actual de Grok cuya tarifa de entrada en caché es más barata que la de sus sucesores. Grok 4.5 cachea a $0.30 por millón de tokens; Grok 4.6 y Grok 4.7 cachean a $0.50, según la propia tabla de precios de xAI.
Aquí está la gama tal como la enumera actualmente la documentación de precios del proveedor, todas las cifras por millón de tokens y todas publicadas por el proveedor:
• Grok 4.20 (tres variantes: multiagente, razonamiento, sin razonamiento) — 1M de contexto, $1.25 de entrada / $2.50 de salida, $0.20 en caché, lanzado el 31 de marzo de 2026
• Grok 4.3 — contexto de 1M, $1.25 de entrada / $2.50 de salida, $0.20 en caché, además de un descuento por lotes; la forma más económica de obtener un millón de tokens de contexto de Grok
• Grok 4.5 — contexto de 500K, $2.00 entrada / $6.00 salida, $0.30 en caché, lanzado el 8 de julio de 2026
• Grok 4.6 — contexto de 500K, $2.00 de entrada / $6.00 de salida, $0.50 en caché, lanzado el 12 de agosto de 2026
• Grok 4.7 — 500K de contexto, $2.00 de entrada / $6.00 de salida, $0.50 en caché, lanzado a principios de septiembre de 2026
• Grok Build 0.1 — contexto de 256K, $1.00 entrada / $2.00 salida, un especialista en programación más que un modelo general
De esa lista se desprenden dos cosas. En primer lugar, Grok 4.5 no recibió una rebaja de precio cuando dejó de ser el buque insignia: mantuvo el precio de buque insignia, lo que significa que Grok 4.6 ahora ofrece estrictamente mejor relación calidad-precio por el mismo dinero, a menos que quieras específicamente la tarifa de caché más barata o estés atado a la instantánea de 4.5. En segundo lugar, Grok 4.5 tiene la mitad del contexto de Grok 4.3 y de la familia 4.20, al doble del precio de entrada. La base V9 es la razón: 1,5 billones de parámetros, aproximadamente tres veces el tamaño de Grok 4.3, y un modelo base más grande es lo que compró la capacidad a costa de la ventana.
Si lo que realmente necesitas es un contexto largo con un presupuesto ajustado, Grok 4.3 es la respuesta honesta dentro de esta familia, y Grok 4.5 no lo es. Ese equilibrio —capacidad frente a ventana— es la decisión definitoria en la línea Grok, y vale la pena decirla con claridad en lugar de pretender que el número más nuevo es mejor en todo.
La ficha técnica

Estas son las especificaciones que xAI publica en su propia página del modelo, no estimaciones de terceros:
• Identificador del modelo — grok-4.5, con los alias grok-4.5-latest y grok-build-latest
• Modalidad — entrada de texto e imagen, salida de texto. Las imágenes se aceptan como entrada; el modelo no las genera
• Ventana de contexto — 500.000 tokens, compartidos entre el prompt y la respuesta en lugar de 500K de entrada más una asignación de salida separada
• Licencia: propietaria. No hay pesos abiertos ni checkpoint descargable; se accede a Grok 4.5 a través de una API o de los productos propios del proveedor.
• Precio de lista — $2.00 por millón de tokens de entrada, $6.00 por millón de tokens de salida, $0.30 por entrada en caché
• Precios de contexto largo — a partir de 200.000 tokens de prompt, la tarifa pasa a $4.00 de entrada / $12.00 de salida / $0.60 en caché, y la tarifa más alta se aplica a cada token de la solicitud, no solo a los tokens que superan el umbral. Este es el detalle más costoso de pasar por alto en toda la página
• Control de razonamiento — cuatro niveles, bajo, medio, alto y xhigh, con alto como valor predeterminado. El razonamiento no se puede desactivar por completo, y los tokens de razonamiento se facturan como tokens de salida
• Compatibilidad con herramientas y formatos: la llamada a funciones y las salidas estructuradas son compatibles de forma nativa. Las herramientas de búsqueda del lado del servidor se facturan además del uso de tokens; no pudimos confirmar las tarifas actuales por llamada en la página del modelo del proveedor, solo que existen.
• Límites de velocidad — 150 solicitudes por segundo y 50 millones de tokens por minuto
• API por lotes — no compatible con Grok 4.5, a diferencia de Grok 4.3
• Regiones de servicio — us-east-1 y us-west-2 en el lanzamiento. Se indicó explícitamente que la disponibilidad europea no estaría disponible el primer día, y el proveedor la describió como prevista para mediados de julio de 2026; no encontramos una declaración posterior de fuente primaria que confirmara la fecha exacta en que se abrió, así que considere la cronología de la UE como no confirmada aquí
Una discrepancia que merece registrarse en lugar de suavizarse: la propia entrada del catálogo de OrcaRouter para grok/grok-4.5 muestra una tarifa de lectura de caché de $0.50 por millón, que coincide con lo que xAI cobra por Grok 4.6 y Grok 4.7 en lugar de los $0.30 que muestra la tabla de precios del proveedor para Grok 4.5. La documentación del proveedor es la autoridad en cuanto al precio; nuestra página parece estar mostrando la tarifa de caché del sucesor, y se ha señalado en lugar de repetirse aquí sin más.
En qué es Grok 4.5 mediblemente bueno
La afirmación principal en el lanzamiento era la economía de tokens, y es la única afirmación de la página de lanzamiento que tiene un mecanismo detrás en lugar de solo una puntuación. En SWE-bench Pro, xAI informa que Grok 4.5 promedia 15.954 tokens de salida por tarea resuelta frente a 67.020 de Claude Opus 4.8 ejecutándose a máximo esfuerzo — aproximadamente 4,2 veces menos tokens para completar el mismo trabajo. Menos tokens de salida por tarea resuelta es la diferencia entre un modelo que es más barato y un modelo que es más barato y más rápido en términos de tiempo transcurrido, porque los tokens de salida son lo que uno espera. Reportado por el proveedor, en el propio entorno de pruebas del proveedor, y no reproducido por nadie independiente — pero es una afirmación estructural, no un porcentaje elegido a dedo.
La tabla comparativa del proveedor, publicada junto con el modelo y, por lo tanto, reportada por el proveedor en su totalidad, se lee así frente a los mismos modelos:
• DeepSWE 1.0 — Grok 4.5 62,0 %, por detrás de Claude Fable 5 con 66,1 % y GPT-5.5 con 64,31 %, por delante de Claude Opus 4.8 con 55,75 %
• SWE Marathon, tasa de resolución — Grok 4.5 29,0 %, por delante de Claude Opus 4.8 con 26,0 % y Claude Fable 5 con 24,0 %. Este es el único benchmark de programación en el que Grok 4.5 lideró el sector
• Terminal-Bench 2.1 — Grok 4.5 83,3%, prácticamente a la par de Claude Fable 5 con 84,3% y GPT-5.5 con 83,4%, por delante de Claude Opus 4.8 con 78,9%
• DeepSWE 1.1 — Grok 4.5 53%, por detrás de Claude Fable 5 con 70% y GPT-5.5 con 67%
• SWE-bench Pro — Grok 4.5 64,7 %, por detrás de Claude Fable 5 con 80,4 % y Claude Opus 4.8 con 69,2 %
La lectura honesta es que Grok 4.5 gana en la resolución de tareas de horizonte prolongado y en la economía de completar una tarea, y pierde en los benchmarks de programación de un solo intento más difíciles. Es un buen modelo para bucles de agentes y uno mediocre para problemas difíciles de un solo intento — y esa distinción es exactamente lo que el número de eficiencia de tokens predice que debería ser.

La perspectiva independiente es más limitada, y es aquí donde esta página tiene que ser cuidadosa. Artificial Analysis actualmente incluye a Grok 4.5 (high) con una puntuación de 39 en el Intelligence Index, en el puesto #52 de 212 modelos, en la versión v4.3.2 del índice — por encima de la mediana de 25 para modelos comparables, pero no cerca de la cabeza. Si has visto una puntuación de 54 o 56 citada para este modelo en la cobertura de julio, no la compares con 39: Artificial Analysis ha revisado el índice desde el lanzamiento y las dos cifras provienen de revisiones diferentes. Este es exactamente el tipo de comparación de cifras obsoletas que hace que las tablas de benchmark no sean fiables, y es por lo que esta página cita la versión del índice junto con la puntuación.
En qué es Grok 4.5 mediblemente malo
Artificial Analysis informa una velocidad de salida de 55,1 tokens por segundo, clasificado en el puesto n.º 126 de 212 modelos y por debajo de la mediana de 74 — muy lejos de los 80 tokens por segundo que xAI citó en el lanzamiento y aún más lejos de los ~340 tokens por segundo que alcanzan los modelos actuales más rápidos. También informa un tiempo hasta el primer token de 10,94 segundos frente a una mediana de 3,86 segundos. Esos dos números juntos describen el costo real de un modelo de razonamiento que se establece de forma predeterminada en alto y no se puede desactivar: esperas y luego habla despacio. Si dejas el nivel de razonamiento en el valor predeterminado, Grok 4.5 se sentirá como el modelo más lento que tengas en la clave.
Tres contras más, sopesados según cuánto deberían afectar a una decisión:
• Artificial Analysis ha marcado Grok 4.5 como obsoleto y dice que continúa evaluando solo la carga de trabajo predeterminada de 10,000 tokens de entrada para él. Eso significa que un tercero te está diciendo que ha dejado de medir por completo el modelo que estás considerando, y recomienda Grok 4.6 en su lugar. Estar obsoleto en una tabla de clasificación no significa que no esté disponible en una API — significa que la base de evidencia independiente está congelada.
• Pierde los dos benchmarks que más se asemejan a la codificación difícil de un solo intento: DeepSWE 1.1 y SWE-bench Pro, tanto ante Claude Fable 5 como ante GPT-5.5, según la propia tabla de xAI
• Tiene la mitad del contexto de Grok 4.3 al doble del precio de entrada, y ninguna API por lotes en absoluto. Si tu carga de trabajo es el procesamiento de documentos largos o la inferencia por lotes sin conexión, Grok 4.5 es el modelo equivocado dentro de su propia familia
Sobre alucinación y calibración, esta página no pudo confirmar una cifra independiente actual. La cobertura de julio difundió una tasa de alucinación en torno al 54 %, pero no pudimos verificar esa cifra en la página del modelo de Artificial Analysis que leímos, y tampoco aparece en la página del proveedor. En lugar de repetir una cifra que no podemos respaldar con una fuente, la registramos aquí como no medida.
¿Quién debería elegir Grok 4.5, y quién debería elegir algo diferente?
Elige Grok 4.5 si ejecutas bucles agénticos en los que el coste por tarea completada importa más que el coste por token, y ya has medido que el comportamiento de economía de tokens de V9 se cumple en tu carga de trabajo. También es la opción correcta si necesitas una instantánea de la familia Grok con una tarifa de 0,30 $ por entrada en caché sobre un prefijo grande, estable y consultado repetidamente; esa tarifa de caché es realmente más barata que lo que cobran Grok 4.6 y Grok 4.7, y en una carga de trabajo con mucho uso de caché esa diferencia puede pesar más que dos generaciones de capacidad.
En su lugar, elige Grok 4.6 o Grok 4.7 para casi todo lo demás. El mismo precio de lista, la misma ventana de 500K, un entrenamiento más reciente, mejores puntuaciones independientes y la propia recomendación de Artificial Analysis. No hay ninguna versión de «quiero el mejor Grok» en la que la respuesta hoy sea 4.5.
Elige Grok 4.3 si el contexto es la limitación: 1M de tokens a $1.25 y $2.50, con un descuento por lotes que Grok 4.5 no ofrece. El RAG de documentos largos y el análisis de repositorios completos siguen siendo su territorio.
Elige algo fuera de la familia si lo que buscas es optimizar la puntuación máxima en lugar del precio por tarea: Claude Fable 5 lidera todos los benchmarks de programación en la propia tabla comparativa de xAI, y GPT-5.5 se sitúa por delante de Grok 4.5 en DeepSWE 1.0 y 1.1. Si quieres pesos abiertos y puedes aceptar un modelo más pequeño, esa es una compra completamente distinta y ningún modelo Grok compite por ella.
Llamar a Grok 4.5 sin un segundo contrato
Grok 4.5 ya está disponible en OrcaRouter al precio de lista de xAI, con la tarifa del proveedor trasladada sin ningún margen, así que los $2.00 y $6.00 de arriba son lo que pagas, y cualquier cambio de precio del proveedor llega a nuestro lado el mismo día que llega al suyo. Eso importa más de lo habitual en este modelo en concreto, porque la decisión que tiene delante la mayoría de los lectores no es «Grok 4.5 o nada», sino «Grok 4.5 o Grok 4.6 o Grok 4.3», y comparar tres modelos de una misma familia es justo lo que un único endpoint con más de 200 modelos abarata. Una sola clave, sin un segundo contrato, y una prueba A/B que es un cambio de cadena en lugar de una integración.
El argumento de la conmutación por error es inusualmente concreto aquí. Grok 4.5 todavía se puede enrutar, pero los rastreadores independientes ya no lo evalúan por completo y ya no es el buque insignia del proveedor: un modelo que quizá quieras en una cadena de respaldo en lugar de como tu única ruta. La conmutación automática por error entre proveedores es el mecanismo que te permite conservarlo para aquello en lo que es bueno sin apostar una ruta de producción a una instantánea que el ecosistema ya ha empezado a dejar atrás.
Lo que esta página no hará es fingir que la elección es obvia. Grok 4.5 es un buen modelo con una fortaleza específica, ubicado en una familia donde el mismo dinero ahora compra uno más nuevo. Si estás empezando de cero hoy, la recomendación honesta es Grok 4.6. Si ya estás ejecutando Grok 4.5 en un bucle de agente y está terminando tareas con los recuentos de tokens que presupuestaste, la recomendación honesta es no cambiar nada y volver a medir en un trimestre.

Grok 4.5 se puede enrutar en OrcaRouter hoy, y también Grok 4.6, Grok 4.7 y Grok 4.3. OrcaRouter transfiere el precio de lista del proveedor con cero margen, por lo que un cambio de precio del proveedor llega a nuestro lado el mismo día en que llega al suyo, y mover una carga de trabajo entre dos modelos Grok es un cambio de cadena en lugar de un segundo contrato.
Comparados en este artículo4
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
