Tarjeta de título principal para la página de referencia de Grok 4.7: el titular «Grok 4.7: La página de referencia» sobre el subtítulo «el modelo de razonamiento insignia de SpaceXAI, lanzado el 21 de septiembre de 2026», luego tres tarjetas redondeadas con los textos «Contexto: 500K tokens», «Precio por 1M: $2.00 entrada / $6.00 salida» y «AA Intelligence: 46», con una línea de pie de página que dice «Especificaciones y precios según la documentación de SpaceXAI; índice AA según Artificial Analysis v4.3.2.» y el logotipo de OrcaRouter en la esquina inferior derecha.
Guides & Insights

¿Qué es Grok 4.7? Especificaciones, precio, ventana de contexto y benchmarks

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Grok 4.7 es el modelo insignia actual de SpaceXAI: un modelo de razonamiento que acepta texto e imágenes, devuelve texto, tiene una ventana de contexto de 500.000 tokens y cuesta $2.00 por millón de tokens de entrada y $6.00 por millón de tokens de salida, con el esfuerzo de razonamiento seleccionable entre cuatro niveles. Sucede a Grok 4.6, lo iguala exactamente en precio y contexto, y está orientado al trabajo de largo horizonte —programación de varias horas, bucles de herramientas agénticas, trabajo de conocimiento profesional— en torno al cual la empresa vende ahora toda su línea de productos. Esta página es la entrada de referencia del modelo: qué es, dónde se sitúa, qué acepta, cuánto cuesta y, después, dos cosas que se mantienen deliberadamente separadas: lo que SpaceXAI dice sobre su propio modelo y lo que midió un evaluador independiente.

Por qué esta es una página de referencia y no una noticia de lanzamiento. Grok 4.7 se lanzó el 21 de septiembre de 2026, y ese lanzamiento ya está cubierto en este blog (consulta el grok-4-7-release-date artículo para ver la lectura del primer día), así que la fecha que aparece abajo se usa como un dato que sitúa al modelo en el tiempo, no como un acontecimiento que se vuelve a informar. El lector para el que existe esta página es el que escribe el nombre a secas del modelo en un cuadro de búsqueda y quiere el modelo, no la noticia: durante los 28 días hasta el 25 de septiembre de 2026, nuestros propios datos de Search Console registran 31.934 impresiones en la consulta exacta "grok 4.7" y 34.160 en todas las grafías que se reducen a ese nombre, con una posición media de 7,8 y sin ninguna página dedicada en la que aterrizar. Eso es una medición de lo que escribe la gente —no dice nada sobre lo bueno que es el modelo— y es la razón por la que la página empieza con la pregunta más sencilla posible. Cada cifra de este artículo está etiquetada según de dónde procede: reportado por el proveedor para todo lo que venga de la propia documentación, publicación de lanzamiento o página de precios de SpaceXAI, independiente para Artificial Analysis, y de elaboración propia para lo que muestran nuestro catálogo y nuestros datos de búsqueda.

Dónde se sitúa Grok 4.7 en la línea de Grok

El proveedor ahora escribe su nombre como SpaceXAI tanto en la documentación para desarrolladores como en la página de noticias, mientras que la API en sí sigue sirviéndose desde api.x.ai y el identificador del modelo sigue siendo de grok. Grok 4.7 está a la cabeza de la línea de texto y es la recomendación predeterminada del propio proveedor: cuando se pregunta qué modelo elegir, la página de modelos responde que para todo excepto el trabajo de audio, imagen y vídeo —«incluido el código»— deberías usar Grok 4.7, porque «es el modelo más capaz que hemos creado». Sus hermanos, según las tarifas publicadas por el propio proveedor por millón de tokens, son:

• Grok 4.6 — contexto de 500K, $2.00 de entrada / $0.50 en caché / $6.00 de salida, lanzado en agosto de 2026. El predecesor directo y el modelo con el que se compara el precio de 4.7.

• Grok 4.5 — contexto de 500K, $2.00 de entrada / $0.30 en caché / $6.00 de salida, lanzado en julio de 2026. Mismo precio de lista que sus sucesores pero una tarifa de caché más barata, que ahora es la única razón concreta para seguir eligiéndolo.

• Grok 4.3 — 1M de contexto, $1.25 de entrada / $0.20 en caché / $2.50 de salida. La mitad del precio del modelo insignia actual y el doble de su ventana de contexto.

• Grok 4.20 (variantes con razonamiento, sin razonamiento y multiagente) — contexto de 1M, $1.25 de entrada / $0.20 en caché / $2.50 de salida.

• Grok Build 0.1 — contexto de 256K, $1.00 de entrada / $0.20 en caché / $2.00 de salida. Un especialista en programación más que un modelo general, y el modelo predeterminado del agente Grok Build es Grok 4.7, no este.

Así que la forma de la línea actual es un intercambio de capacidad frente a ventana: el buque insignia te da 500K de contexto a $2/$6, y el nivel 4.3/4.20 te da un millón de tokens completo a aproximadamente la mitad del precio de entrada y menos de la mitad del precio de salida. Nada en la documentación del proveedor sugiere que Grok 4.7 sea una arquitectura diferente de Grok 4.6: lo que describe el lanzamiento es un modelo base más grande, una ejecución de aprendizaje por refuerzo más prolongada y ponderada hacia tareas que tardan muchas horas en completarse, mejor autoverificación, mejor manejo de contextos largos y entrenamiento con el arnés de Grok Bot para que el modelo se comporte mejor en trabajo conversacional y de conocimiento general. Una afirmación de mejora, no un diseño nuevo. SpaceXAI no publica un recuento de parámetros para Grok 4.7 ni en su página del modelo ni en su tabla de precios, y esta página no lo adivinará.

Cuándo se lanzó y qué se lanzó con él

La publicación de lanzamiento está fechada el 21 de septiembre de 2026, y la página del modelo para desarrolladores lleva la misma fecha como su última actualización, que es tan precisa como esto puede ser — SpaceXAI no publica una marca de tiempo de lanzamiento más allá del día. Lo que se lanzó ese día no fue solo un identificador de modelo. grok-4.7 El slug se puso en funcionamiento tanto en Responses API como en Chat Completions con una ventana de contexto de 500,000 tokens, una fecha de corte de conocimiento de mayo de 2026, cuatro niveles de razonamiento, incluido un nuevo ajuste superior, una variante Fast restringida a dos superficies propias, un endpoint regional solo para EE. UU. y precios de lista idénticos a los de Grok 4.6. Al mismo tiempo, se convirtió en el modelo predeterminado del agente de programación Grok Build y se puso a disposición en Cursor en todos los planes. Si quieres la reacción del primer día en lugar de la especificación, el artículo grok-4-7-release-date cubre ese terreno; esta página toma la misma fecha como un hecho sobre el modelo y pasa a lo que realmente hará por ti.

El sobre: qué puedes enviar y cuánto de ello

Todo lo siguiente proviene de la propia página del modelo y la página de modelos de SpaceXAI, leídas el 28 de septiembre de 2026, a menos que se indique lo contrario.

Screenshot of SpaceXAI's developer documentation page for grok-4.7, showing the model identifier grok-4.7, the tagline describing it as SpaceXAI's frontier model built for coding, agentic tasks and knowledge work, an At a glance block with Context, Modalities, Training data and Pricing rows, an Important details section, a Fast variant note, and a Where it runs list, plus a Python code sample setting the model name to grok-4.7 in the xai_sdk client.

Ventana de contexto: 500.000 tokens. Igual que Grok 4.6, la mitad de lo que ofrecen Grok 4.3 y la familia 4.20.

• Fecha de corte de conocimiento — mayo de 2026, tres meses después que la de Grok 4.6. Cualquier cosa más reciente requiere activar una herramienta de búsqueda; el modelo no tiene conocimiento en tiempo real de forma predeterminada.

• Entrada — texto e imagen. Las imágenes pueden ser JPG/JPEG o PNG, de hasta 20 MiB cada una, y el proveedor no documenta ningún límite en la cantidad de imágenes por solicitud; la imagen y el texto pueden aparecer en cualquier orden.

• Salida — solo texto. En este modelo no hay generación de imágenes, audio ni video; esos son modelos separados de la línea SpaceXAI.

• Techo de salida — el proveedor afirma que no hay límite de salida de texto. Nuestra propia ficha de modelo de OrcaRouter para grok-4.7 indica una salida máxima de 450,000 tokens, y las dos cifras no coinciden. Lo estamos señalando en lugar de elegir una en silencio: la documentación de SpaceXAI es la autoridad sobre el modelo de SpaceXAI, y la lectura honesta es que el proveedor no publica un tope de salida de texto.

• Control de razonamiento — reasoning_effort acepta low, medium, high (el valor predeterminado del proveedor) o xhigh. xhigh es nuevo en esta generación; Grok 4.6 también ofrecía cuatro niveles, y las cifras de referencia publicadas para 4.7 se citan en xhigh.

• Herramientas — llamada a funciones, búsqueda web, búsqueda en X y ejecución de código, todo documentado como herramientas del lado del servidor.

Salida estructurada: el proveedor documenta una capacidad de salidas estructuradas junto con la generación de texto; nuestra propia página la expone como response_format y structured_outputs.

• Parámetros que acepta nuestra página: include_reasoning, logprobs, max_tokens, reasoning, reasoning_effort, response_format, seed, structured_outputs, temperature, tool_choice, tools, top_logprobs y top_p. Una advertencia que conviene conocer antes de basarte en logprobs: la página de modelos de SpaceXAI indica que logprobs y top_logprobs no son compatibles con grok-4.20 ni con modelos más recientes, y que "se ignorarán silenciosamente si se establecen", lo que abarca a Grok 4.7. Que nuestra página los incluya no garantiza que el upstream los devuelva.

• Endpoints — la API de Chat Completions compatible con OpenAI y la API de Responses.

• Caché de prompts — el proveedor recomienda configurar prompt_cache_key en la API de Responses (el encabezado x-grok-conv-id en Chat Completions) para que las solicitudes de una conversación lleguen al mismo servidor; sin él, la documentación advierte que a menudo pagas el precio completo de entrada en un servidor con la caché fría. La entrada en caché se factura a $0.50 por millón de tokens por debajo del umbral de 200K.

• Razonamiento cifrado — en la API de Responses, Grok 4.7 siempre devuelve reasoning.encrypted_content, incluso cuando no lo solicitas, de modo que las llamadas de varios turnos conservan el razonamiento del modelo sin necesidad de configuración adicional. Chat Completions no cambia.

El tarifario, en su totalidad

Los precios se organizan en niveles según el tamaño del prompt, y una vez que se supera el umbral, este se aplica a toda la solicitud, no solo a los tokens que quedan por encima del límite. Todas las cifras que aparecen aquí están publicadas por el proveedor y se tomaron de la página de precios de SpaceXAI el 28 de septiembre de 2026:

• Estándar, prompts de menos de 200K tokens — $2.00 de entrada / $0.50 de entrada en caché / $6.00 de salida por millón de tokens.

• Contexto extenso, prompts de 200K tokens o más: $4.00 de entrada / $1.00 de entrada en caché / $12.00 de salida por millón de tokens.

• Grok 4.7 Fast — el mismo modelo en una infraestructura más rápida al doble de las tarifas estándar: $4.00 / $1.00 / $12.00 por debajo de 200K, y $6.00 / $1.50 / $18.00 por encima. Solo está disponible a través de Cursor y Grok Build, no está en la API pública en absoluto, y el nivel gratuito de Grok Build no lo incluye.

• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.

Si se compara con el resto del mercado, lo interesante no es la tarifa anunciada —$2 de entrada y $6 de salida es exactamente lo que cobraba Grok 4.6 y lo que Grok 4.5 sigue cobrando—, sino el descuento por caché, que el proveedor publica con un 75 % de descuento sobre la entrada para prefijos de prompt repetidos. Para un bucle de agente largo que reenvía el mismo prompt del sistema y el mismo contexto de archivo en cada turno, ese descuento es la diferencia entre el precio de lista y la factura. También es la única línea en la que Grok 4.7 es peor que su hermano mayor: Grok 4.5 almacena en caché a $0.30 por millón frente a los $0.50 de Grok 4.7.

Grok 4.7 está en OrcaRouter como grok/grok-4.7al precio de lista propio de SpaceXAI, con 0 % de margen: el precio del proveedor se transfiere tal cual, de modo que un cambio de precio del proveedor se refleja aquí el mismo día en lugar de después de un proceso de reajuste de precios. Eso importa más de lo habitual en un modelo con un umbral de prompt de dos niveles y una tarifa de caché, porque ambos modifican lo que pagas realmente. Es una sola clave y un único endpoint compatible con OpenAI para toda la línea Grok, así que cambiar una carga de trabajo de Grok 4.7 a Grok 4.5 o 4.3 para probar la diferencia de costo es un cambio de cadena en lugar de un segundo contrato.

Lo que SpaceXAI afirma al respecto

Todo en esta sección es reportado por el proveedor. Nada de esto ha sido reproducido de forma independiente, y la configuración de esfuerzo importa — la tabla en la publicación de lanzamiento cita Grok 4.7 en xHigh, Grok 4.6 en High, y los dos modelos de comparación en Max, lo cual no es una comparación equiparable.

• CursorBench 4.0 — 46,3 % para Grok 4.7 en xHigh, frente al 40,4 % de Grok 4.6 en High. El propio planteamiento del post de lanzamiento es que aquí es donde Grok 4.7 se encuentra "en la frontera en cuanto a precio-rendimiento".

• Terminal-Bench 4.0 — 37,6 %, frente al 20,3 % de Grok 4.6. El mayor delta individual del lanzamiento, y el que coincide con la afirmación de «RL más prolongado en tareas más difíciles».

• DeepSWE v1.1 — 71.0%, marcado en la propia tabla del proveedor como una puntuación de alto esfuerzo, frente al 65.2% de Grok 4.6.

• AA Briefcase v1.1 — 1.657, frente a 1.546 de Grok 4.6. Nótese la colisión de nombres: aquí es el proveedor citando un benchmark que Artificial Analysis también ejecuta, y el resultado independiente se analiza en la sección siguiente.

• EEBench — 64,0 %, frente a 53,0 % de Grok 4.6.

• Harvey Legal Agent Benchmark — 19,6%, frente al 15,8% de Grok 4.6.

• HealthBench Professional — 56,7%, frente al 48,5% de Grok 4.6.

• GDPval — 1695 Elo con xhigh, frente a los 1605 de Grok 4.6 con high.

Las afirmaciones de seguridad también son reportadas por el proveedor y son inusualmente específicas: SpaceXAI dice que Grok 4.7 se construyó sobre una nueva pila de salvaguardas, que encabeza el benchmark de bioseguridad de LatchBio con un 62,4 % y que, en su propio HackerBench v0.3, solo deja pasar el 3,3 % de los prompts riesgosos de doble uso, mientras que rara vez bloquea trabajo de seguridad legítimo. La empresa también dice que ha comenzado a dar a socios seleccionados de ciberseguridad acceso solo por invitación a las capacidades de red team del modelo. Toma todo eso como pruebas del propio proveedor sobre su propio modelo: es un conjunto de afirmaciones lo bastante específico como para comprobarlo más adelante, lo cual no es lo mismo que comprobado ahora. El posicionamiento de una línea en la publicación de lanzamiento, “el doble de rápido, a la mitad del precio de modelos comparables”, es marketing sobre rivales en lugar de una medición de Grok 4.7, y la cifra de velocidad independiente que aparece abajo no respalda la mitad de “el doble de rápido”.

A single-column scoreboard card for Grok 4.7 titled "Grok 4.7 - the scoreboard" with six rows: Context window 500K tokens; Knowledge cutoff May 2026; Reasoning levels low / medium / high / xhigh; Price per 1M $2.00 in / $6.00 out; AA Intelligence Index 46, #21 of 211; Output speed 82.6 tokens/sec. Footer: "Rows 1-4 vendor-reported; AA Index and speed per Artificial Analysis v4.3.2, xhigh configuration."

Lo que midió un evaluador independiente

Artificial Analysis es la única fuente de esta historia que no tiene ningún interés en el modelo, y su página de Grok 4.7 es explícitamente la configuración xhigh. Leído el 28 de septiembre de 2026:

• Inteligencia — 46 en el Artificial Analysis Intelligence Index, versión del índice v4.3.2, lo que lo sitúa en el puesto 21 de 211 modelos en esa tabla y muy por encima de la mediana de 26 del índice. Ese índice es un compuesto de diez evaluaciones: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience y AA-LCR v1.1.

• Costo — $3.74 por ejecutar Intelligence Index una vez, con el mismo evaluador publicando el descuento de caché al 75% y una tarifa de entrada/salida que coincide con la del proveedor ($2.00 / $6.00). Su propio comentario es que el modelo tiene un "precio razonable al compararlo con otros modelos de precio similar".

• Verbosidad — 240M tokens de salida generados en el Intelligence Index, frente a una mediana de 88M. Artificial Analysis lo califica de "muy verboso", y es el número más útil aquí para cualquiera que esté presupuestando: un modelo que piensa en cadenas más largas cuesta más por tarea incluso a una tasa de tokens fija.

• Velocidad — 82,6 tokens de salida por segundo, puesto 83 de 211 en esa tabla, que el evaluador, no obstante, califica de "más lento que la media". Dos salvedades antes de llevar esta cifra a cualquier parte. Artificial Analysis cambió su carga de trabajo de referencia predeterminada a una entrada de 10.000 tokens para reflejar mejor el uso en producción, y su lectura de velocidad publicada para este modelo ha cambiado de forma significativa entre instantáneas, así que trátala como una instantánea de una única carga de trabajo, no como una constante. En cuanto a los proveedores de API, el mismo evaluador solo tiene un proveedor listado para el modelo —la propia SpaceXAI—, por lo que su latencia medida y su precio combinado son cifras propias, no un diferencial de mercado.

Nuestro propio catálogo incluye tres resultados adicionales de Artificial Analysis para Grok 4.7, evaluados el 21 de septiembre de 2026: 43,1 % en Humanity's Last Exam, 76,7 % en la evaluación de recuperación de contexto largo y 57,4 % en SciCode. Están etiquetados como independientes porque proceden de Artificial Analysis, y conviene leerlos junto con las afirmaciones de autoverificación del proveedor, más que como una confirmación de estas.

La nota de comparación honesta: las cifras de SpaceXAI y las cifras de Artificial Analysis se generaron con distintos arneses y con distintos ajustes de esfuerzo, y ambas no se han ejecutado cara a cara en una configuración equiparable. Donde el mismo nombre de benchmark aparece en ambos lados —AA Briefcase, Terminal-Bench 4.0—, eso es un nombre compartido, no una ejecución compartida. Cualquiera que cite una cifra de un proveedor junto a una cifra independiente como si fueran una sola medición está haciendo una aritmética que la evidencia no respalda.

Donde realmente puedes llamarlo

Grok 4.7 se puede invocar desde el día de su lanzamiento a través de la propia API de SpaceXAI en api.x.ai, usando la API de Responses o Chat Completions, y mediante el endpoint regional exclusivo para EE. UU. con un recargo del 10 %. Es el modelo predeterminado del agente de programación Grok Build y está disponible en Cursor en todos los planes, con la variante Fast —el mismo modelo al doble de tarifa— restringida a esas dos superficies y ausente de la API pública. Más allá del acceso de primera parte, el proveedor lo describe como disponible a través de arneses de programación de terceros, enrutadores de modelos y plataformas en la nube.

Por nuestra parte, en concreto: grok/grok-4.7 ya está disponible hoy en el catálogo de OrcaRouter, con los precios de lista de xAI y un 0 % de recargo y se puede invocar en cualquiera de los dos endpoints con la misma clave que el resto de la línea Grok. Si lo estás evaluando frente a Grok 4.6 —mismo precio, misma ventana, un modelo distinto por debajo—, enrutar ambos a través de un único endpoint con una cadena de conmutación por error automática es la forma barata de averiguar cuál prefiere en realidad tu carga de trabajo, en lugar de comprometer una ruta de producción con el modelo más nuevo basándote en la tabla de un proveedor.

Screenshot of the OrcaRouter model page for grok/grok-4.7, showing the SpaceXAI provider label, the 500K-token context window and 450K maximum output, capability tags for Vision, Tools, JSON and Reasoning, the $2.00 per million input and $6.00 per million output rates, the Public benchmarks panel dated 2026-09-21 with an AA Intelligence figure of 46.4, and the /v1/chat/completions and /v1/responses endpoints.

Qué observar, dado lo escaso que aún es el historial. SpaceXAI no ha publicado un recuento de parámetros, y la cuestión del techo de salida está genuinamente abierta — el «sin límite de salida de texto» del proveedor frente a los 450K que muestra nuestra propia página es una discrepancia que nadie ha resuelto todavía. No hay una comparación cara a cara con el mismo arnés frente a los modelos contra los que se vende. Y la lectura de velocidad anterior es la cifra con más probabilidades de cambiar, porque ya lo ha hecho. Esos son los tres puntos en los que esta página necesitará edición a medida que se complete el historial, y es mejor decirlo que fingir que la especificación está resuelta.

Grok 4.7 se puede enrutar en OrcaRouter hoy, y también Grok 4.6, Grok 4.5, Grok 4.3 y la familia Grok 4.20. OrcaRouter pasa el precio de lista del proveedor sin margen de ganancia, por lo que el umbral de prompt de dos niveles de SpaceXAI y su tarifa de caché llegan a nuestro lado el mismo día en que cambian en el suyo, y probar una carga de trabajo con los modelos Grok más antiguos y económicos es un cambio de cadena en lugar de un segundo contrato.

Comparados en este artículo3

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario