
Dots vs Grok 4.6: El agente que agenda sus propias reuniones contra el modelo que responde
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 349 tok/s
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2237Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAINUEVOGrok 4.72026-09-2146Inteligencia
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens · 208 tok/s
- OrcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- xAISpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
Intenta escribir un número de teléfono para un dot y fracasarás, y ese fracaso es lo más útil de esta combinación. Dots es el agente siempre activo de la empresa, anunciado en DevDay el 29 de septiembre de 2026: cada dot obtiene su propia computadora en la nube y su propio navegador, se conecta a más de 4,000 aplicaciones y es accesible dentro de ChatGPT, Slack y Teams, se ejecuta sobre GPT-6 Astra y está incluido con Pro y Business Premium sin cargo adicional. Grok 4.6 es el modelo de frontera de SpaceXAI, publicado el 12 de agosto de 2026, y es un tipo de objeto completamente diferente: una ventana de contexto de 500,000 tokens, entrada de texto, imagen y archivos con salida de texto, esfuerzo de razonamiento configurable, llamada nativa a herramientas y salidas estructuradas, con un precio de $2.00 por millón de tokens de entrada y $6.00 por millón de salida por debajo de un prompt de 200,000 tokens y el doble por encima de eso. Uno de estos es un colega con horario. El otro es una función que invocas.
Ambos son genuinamente sólidos en el trabajo agéntico, y eso es lo que hace que la confusión sea tan común. Grok 4.6 registra 88.4 en Terminal-Bench 2.1 y 50.7 en el segmento de uso de herramientas de τ-banking — el tipo de cifras que hacen que a un modelo se lo describa como «un agente». No lo es. Es el motor de razonamiento con el que se construiría uno.
Lo que realmente es cada uno
• Identidad — un producto alojado sin un identificador de modelo al que puedas dirigirte (Dots) frente a un modelo con nombre y enrutable con una cadena estable que puedas poner en un archivo de configuración (Grok 4.6)
• Dónde ocurre la ejecución — en la computadora en la nube de OpenAI, con su propio navegador, aislada de tu máquina a menos que los vincules (Dots) frente a dondequiera que ejecutes la llamada: un contenedor que controlas, un trabajador de cola, una tarea cron (Grok 4.6)
• Alcance — más de 4000 aplicaciones a través de los conectores de OpenAI (Dots) frente a las herramientas que conectes tú mismo, porque la llamada a herramientas es un protocolo y no un directorio (Grok 4.6)
• Memoria de una tarea — transportada por el producto a lo largo de días, entre apps, a través de nuevos hilos (Dots) frente a una ventana de 500.000 tokens y lo que persistas tú mismo (Grok 4.6)
• Costo — incluido con una suscripción, asignación no publicada (Dots) frente a $2.00 y $6.00 por millón de tokens, duplicándose después de 200,000 tokens de entrada, con lecturas en caché a $0.50 (Grok 4.6)
• Evidencia — demostración del proveedor y declaraciones de capacidades, sin benchmark independiente (Dots) frente a un Artificial Analysis Coding Index de 76.8, quinto de 138 modelos medidos, y 94.9 en GPQA Diamond (Grok 4.6)
El número que decide la mayoría de las preguntas: la asignación
OpenAI publicó un precio para dots y no es un precio en ninguna unidad con la que se pueda medir el trabajo. El primer dot está incluido con Pro o Business Premium; las conversaciones con él no consumen los límites de uso de ChatGPT; los límites extendidos se aplican durante el primer mes. Esa es toda la estructura de costos publicada. No hay cifra de asignación, ni precio del segundo dot, ni tarifa por tarea, ni precio empresarial para los dots especializados que, según se informa, están en pruebas internas. En el informe de CNBC sobre la keynote, la directora financiera Sarah Friar presenta el nivel Pro 500 de $500 al mes como una asignación de uso más el nuevo modo Ultrafast, y no como una tarifa por dot, lo que significa que el plan más caro de la hoja de precios de OpenAI todavía no arroja un costo por unidad de trabajo de agente.
Grok 4.6 va por el camino opuesto y lo publica todo, incluida la parte que duele. La frontera de nivel en 200.000 tokens de entrada es un acantilado: una solicitud de 199.000 tokens se factura a la mitad de la tarifa que una de 201.000. Eso no es una trampa oculta, es un número en la lista de tarifas, y cambia cómo diseñas un trabajo de contexto largo. Divides en fragmentos en la frontera o aceptas el segundo nivel a sabiendas.

Un sucesor salió a la venta mientras se comparaba este par
Grok 4.7 se publicó el 21 de septiembre de 2026 y ahora es el buque insignia de la línea Grok, con el mismo contexto de 500.000 tokens, la misma superficie de entrada, los mismos precios base y una salida máxima mucho mayor, de 450.000 tokens. Grok 4.6 sigue disponible y todavía se lista como un modelo vigente —un salto de versión no es una retirada—, pero cualquiera que elija un modelo Grok hoy debería elegir entre 4.6 y 4.7 en lugar de asumir que 4.6 es la frontera. La razón para decirlo sin rodeos es que el artículo que estás leyendo trata de una comparación que sobrevive a la transición: sin importar cómo se llame el modelo más alto de la línea Grok el próximo trimestre, sigue siendo un modelo de pago por uso con un tarifario, y un dot sigue siendo una suscripción con una asignación no publicada.
Ese es también el argumento para encaminar las llamadas a tu modelo a través de una abstracción en lugar de un proveedor fijado en el código. Cuando llegue el sucesor, cambiar el modelo es editar una sola línea en lugar de hacer una migración.

Construir el agente en lugar de alquilarlo
La consecuencia interesante de esta combinación es que Grok 4.6 te permite construir lo que vende Dots, mal y luego mejor. Un bucle que lee una cola, llama al modelo con herramientas adjuntas, escribe resultados y reintenta en caso de fallo no es difícil; lo difícil son las partes que un dot te da gratis: un navegador que se comporta como el de una persona, conectores escritos por los proveedores de la aplicación, un flujo de aprobación y un registro de actividad. Esas cosas merecen una suscripción precisamente porque son tediosas.
Donde gana el lado de pago por uso es en el momento en que el trabajo deja de ser genérico. En el momento en que necesitas que la misma llamada se ejecute contra un proveedor distinto el próximo trimestre, que se pueda reproducir a partir de un registro, que se calcule su precio al céntimo, o que conmute a un hermano más barato en pleno vuelo cuando un proveedor upstream se tambalea. En OrcaRouter, Grok 4.6 se sirve como grok/grok-4.6 al precio de lista de SpaceXAI con un 0 % de margen añadido —la tarifa propia del proveedor, trasladada tal cual, de modo que una rebaja de precio del proveedor llega a tu factura ese mismo día— en el mismo catálogo que más de 200 otros modelos tras una sola clave, con conmutación automática por error y un DSL de enrutamiento para componer varios modelos en una sola llamada. No hay equivalente para un punto: ni endpoint, ni identificador, nada desde lo que conmutar.
La prueba a aplicar
Pregúntate si el trabajo seguiría existiendo si nadie lo mirara. Si la respuesta es sí —tiene que ocurrir según un calendario, a través de varias herramientas, sin que una persona abra una ventana de chat—, un dot es el producto diseñado para eso, y el modelo de pago por uso es un componente dentro de lo que construyas. Si la respuesta es no, si alguien está esperando el resultado y el resultado tiene un formato y una fecha límite, entonces un modelo de pago por uso es la compra correcta y un agente es un desvío caro.
El error que conviene evitar es comprar un punto para obtener una respuesta mejor. Un punto no es un modelo más inteligente; es una correa más larga sobre uno. Y el segundo error es pagar una suscripción para obtener una capacidad que una lista de tarifas ya te vende por token, con la aritmética visible de antemano.

Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
