
Grok 4.7 vs. DeepSeek V4 Pro: Uno es nuevo, al otro te lo están cambiando por debajo
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Una nota publicada el 10 de septiembre de 2026 cambia de qué trata esta comparación. «Estamos retirando V4-Pro», dice, y a partir de las 04:00 UTC del 14 de septiembre de 2026, cada solicitud a la cadena de modelo deepseek-v4-pro se enruta a DeepSeek-V4.1-Flash con tarifas de V4.1-Flash —una situación que, según la publicación, continúa «hasta que se lance V4.1-Pro». La cadena de modelo sigue respondiendo. El modelo que hay detrás no es el que evaluaste con benchmarks. Eso hace que una comparación directa contra Grok 4.7 —lanzado por el proveedor el 21 de septiembre de 2026, un día antes de que se escribiera esto— sea una comparación con fecha de caducidad en uno de sus lados. Según los números que existen, Grok 4.7 es el modelo más fuerte y DeepSeek V4 Pro es el más barato. En la cuestión que en realidad decide una integración, solo uno de ellos sigue siendo lo que dice ser.
Qué es cada modelo, antes de las puntuaciones
DeepSeek V4 Pro alcanzó la disponibilidad general el 13 de agosto de 2026 como el checkpoint DeepSeek-V4-Pro-0813, tras una vista previa del 24 de abril. Es de pesos abiertos bajo MIT —la licencia permite el uso comercial, la modificación y la redistribución sin umbral de ingresos ni excepción regional—, con 1,7 billones de parámetros totales en la ficha del modelo de GA, una ventana de contexto de 1M de tokens y una salida máxima de 384K, el límite de salida más alto de esta comparativa. Es solo texto: la propia página de precios de DeepSeek indica que la visión no es compatible con v4-pro, lo que supone una limitación real para cualquiera que le proporcione capturas de pantalla o PDF. Expone un control de esfuerzo de razonamiento en bajo, alto y máximo, y está limitado a 500 solicitudes simultáneas por cuenta, con ampliación disponible bajo petición.
Grok 4.7 es de pesos cerrados y tiene un día de antigüedad. Maneja un contexto de 500k tokens —la mitad que el de DeepSeek—, acepta texto e imágenes y ejecuta su propio control de esfuerzo. Su precio de lista es de $2.00 por millón de tokens de entrada y $6.00 por millón de tokens de salida por debajo de 200k tokens de prompt, duplicándose a $4.00 y $12.00 en o por encima de ese umbral, con lecturas en caché a $0.50 y $1.00. xAI también lista una variante más rápida a aproximadamente el doble de velocidad de salida y el doble de precio. Ninguno de los proveedores publica una cifra máxima de salida para Grok 4.7 en la documentación consultada aquí, así que trate esa dimensión como desconocida en lugar de igual.
En el índice compartido, la brecha está desequilibrada en una dirección
Ambos modelos se puntúan en el Artificial Analysis Intelligence Index v4.3.2, la revisión publicada el 19 de septiembre de 2026. La columna de Grok 4.7 se mide con esfuerzo xhigh; la de DeepSeek es el checkpoint 0813 con esfuerzo máximo. Al leerlos en conjunto, la brecha compuesta subestima lo diferentes que son estos dos modelos en su configuración.
• Compuesto — Grok 4.7: 46 en el Artificial Analysis Intelligence Index v4.3.2. DeepSeek V4 Pro 0813: 36 en la misma revisión.
• Agentes de terminal — Grok 4.7: Terminal-Bench 4.0 26. DeepSeek V4 Pro: 14. Casi el doble, en la evaluación más cercana al trabajo de software autónomo.
• Automatización — Grok 4.7: AutomationBench-AA 66 %. DeepSeek V4 Pro: 57 %. Ambos son creíbles; Grok lidera por nueve.
• Conocimiento y alucinación — Grok 4.7: AA-Omniscience 32. DeepSeek V4 Pro: 1. Este es el valor atípico del tablero, y no es un artefacto de redondeo: el índice puntúa tanto lo que un modelo sabe como la frecuencia con la que inventa una respuesta cuando no la sabe.
• Contexto largo — Grok 4.7: AA-LCR v1.1 77 %, ventana de 500k. DeepSeek V4 Pro: 80 %, ventana de 1M. La única victoria clara de DeepSeek, y es el eje para el que se diseñó su ventana de 1M.
• Razonamiento avanzado — Grok 4.7: HLE 43, CritPt 18. DeepSeek V4 Pro: HLE 41, CritPt 18. Un empate en el benchmark de física y una ventaja de dos puntos para Grok en HLE.
• Verbosidad — Grok 4.7: 240M de tokens de salida para ejecutar el índice, marcado como inusualmente verboso. DeepSeek V4 Pro: 163M. Ambos son verbosos; Grok lo es más.

La historia del precio no es un solo número, es un cronograma.
El precio de DeepSeek es lo más agresivo que tiene y lo menos estable de cotizar. La tarifa de lista de deepseek-v4-pro es de $0.66 por millón de tokens de entrada en un fallo de caché y $1.98 por millón de tokens de salida, durante las horas valle. Durante las horas punta, esas cifras se duplican a $1.32 y $3.96. La hora punta, según la propia documentación de DeepSeek, es de 01:00 a 04:00 y de 06:00 a 10:00 UTC, de lunes a viernes, excluidos los días festivos públicos chinos; todo lo demás, incluidos los fines de semana completos, está fuera de horas punta a exactamente mitad de precio. Las lecturas de entrada en caché son el verdadero titular: $0.022 fuera de horas punta y $0.044 en horas punta, treinta veces más baratas que un fallo de caché, lo que hace que una carga de trabajo de DeepSeek bien cacheada sea drásticamente más barata de lo que sugiere su tabla de tarifas.
Frente a eso, los $2,00 y $6,00 de Grok 4.7 parecen caros: aproximadamente 3 veces la entrada fuera de horas punta de DeepSeek y 3 veces su salida fuera de horas punta. La comparación se estrecha de formas que conviene conocer. El precio de Grok 4.7 es plano dentro de su banda en lugar de depender del reloj, de modo que un pico de producción a las 09:00 UTC cuesta lo mismo que un lote de un domingo por la noche; el de DeepSeek no. Y por encima de 200k tokens de prompt, Grok 4.7 se duplica, y en ese punto pasa a ser de cuatro a seis veces la tarifa fuera de horas punta de DeepSeek en lugar de tres. La forma clara de decirlo: DeepSeek V4 Pro es el modelo más barato en todos los ejes, y el tamaño del descuento depende de cuándo lo ejecutes y de lo bien que aproveches la caché.
Lo que cambió el 14 de septiembre
Esta es la parte que hace que el argumento del precio sea más difícil de sostener. A partir del 14 de septiembre de 2026, DeepSeek enruta las solicitudes de deepseek-v4-pro a DeepSeek-V4.1-Flash y las factura a las tarifas de Flash, que son aún más bajas. El registro de cambios de DeepSeek y su página de precios cuentan una historia ligeramente distinta de la que cuenta la publicación de noticias del 10 de septiembre: la tabla de precios sigue incluyendo deepseek-v4-pro como una fila activa, con sus propias tarifas y sin etiqueta de retiro, y la entrada del registro de cambios dice que el servicio de API para V4 Pro continúa después del 14 de septiembre con la facturación sin cambios. Lo que no está en disputa es la dirección en la que se avanza. Se ha confirmado que V4.1-Pro está en desarrollo, sin fecha anunciada, y V4.1-Flash —lanzado el 10 de septiembre— es el que, según el propio anuncio de DeepSeek, supera a V4 Pro en «rendimiento, coste, velocidad y tiempo total de ejecución», una afirmación del proveedor que no se ha reproducido de forma independiente con esa amplitud.
Entonces, la pregunta práctica no es «Grok 4.7 o DeepSeek V4 Pro», sino «Grok 4.7 o el modelo DeepSeek al que esa cadena se resuelva el próximo trimestre». Si evaluaste V4 Pro en agosto y dimensionaste tu presupuesto de contexto en torno a una ventana de 1M con un límite de salida de 384K, el modelo al que llames en noviembre puede que no sea el que mediste, y los límites de contexto y salida del sucesor no son aquellos contra los que diseñaste. Grok 4.7 tiene el perfil de riesgo opuesto: un modelo de un día de antigüedad cuyas cifras son reportadas por el proveedor y en gran medida no reproducidas, pero cuya identidad no está en duda.

Dónde encaja un router y dónde no
OrcaRouter ofrece DeepSeek V4 Pro, y la página del modelo lo lista a la tarifa del propio proveedor — $0.66 de entrada y $1.98 de salida con una ventana de contexto de 1M y una salida máxima de 384k — porque trasladamos los precios de lista del proveedor con un 0 % de margen. Eso importa más de lo habitual con un proveedor cuyas tarifas cambian según un calendario de horas punta y horas valle y cuyo anuncio del 10 de septiembre vino con una reducción de precio: un cambio de precio de DeepSeek se aplica en la misma clave el mismo día, sin retraso de reajuste de precios y sin un segundo contrato. Cuando un proveedor redirige una cadena de modelo en su extremo, el cambio llega a través del mismo endpoint en lugar de requerir una reintegración en el tuyo, y la conmutación por error automática evita que un límite de velocidad o un evento de capacidad del lado del proveedor se convierta en una interrupción del servicio — algo útil cuando uno de los lados de tu stack está limitado a 500 solicitudes concurrentes. Grok 4.7 no está en el catálogo de OrcaRouter a día de hoy; llamarlo implica pasar por la propia API de xAI y por las plataformas de terceros que lo ofrecen.
La división que esto sugiere es poco glamurosa pero defendible: mantén DeepSeek V4 Pro en las cargas de trabajo donde el precio de aciertos de caché y la ventana de 1M están haciendo el trabajo, y fija tus expectativas en V4.1-Flash en lugar del checkpoint de agosto. Pon Grok 4.7 en las tareas donde el modelo tiene que saber lo que no sabe —un índice AA-Omniscience de 1 es una señal fuerte sobre la disposición de un modelo a responder con confianza y de forma incorrecta, y ninguna ventaja de precio sobrevive a que un consumidor aguas abajo confíe en una respuesta fabricada.
La llamada
Grok 4.7 es el mejor modelo aquí, y no por un margen especialmente estrecho: una ventaja compuesta de diez puntos, el doble de puntuación en Terminal-Bench, una ventaja en automatización y una brecha de honestidad de conocimiento lo bastante amplia como para ser una diferencia de categoría. DeepSeek V4 Pro es aproximadamente 3 veces más barato fuera de horas punta y tiene el doble de ventana de contexto, lo que es una razón real y defendible para conservarlo; pero no estás comprando el modelo que evaluaste, estás comprando una cadena de modelo que DeepSeek ya ha anunciado que redirigirá, a tarifas que cambian cada hora, con una licencia y un conjunto de pesos que hacen del autoalojamiento una tercera opción genuina. Si la carga de trabajo es de contexto largo, alto volumen y almacenable en caché, la economía de DeepSeek es difícil de superar y deberías diseñar para el sucesor en lugar del checkpoint. Si es para cualquier cosa en la que equivocarse resulte caro, paga 3 veces más y elige el modelo que admite incertidumbre.

Comparados en este artículo2
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
