Tarjeta de título principal para el artículo 'Gemini 4 Carbon — INFORME DE FILTRACIÓN' con una insignia de 'SIN VERIFICAR', el subtítulo 'Un checkpoint interno de Google al que el público no puede acceder: lo que dice el informe', tres chips que dicen 'Fuente: Business Insider vía TestingCatalog', '9–10 de octubre de 2026' y 'Probado en Jetski, la plataforma interna de Google', una tarjeta izquierda que dice 'La afirmación: los primeros comentarios internos sitúan a Carbon a la par de Claude Opus 5.5 en programación', y una tarjeta derecha que dice 'El contexto: Barium-B es el checkpoint elegido para el lanzamiento público de Gemini 4 Argon'. El logotipo de OrcaRouter está compuesto en la esquina inferior derecha.
Guides & Insights

Filtración de Gemini 4 Carbon: el punto de control interno de Google que, según sus empleados, programa como Claude Opus 5.5

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos →
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Hay una versión de esta historia que es noticia y una versión que es ruido, y la diferencia está por completo en aquello a lo que se atribuyen los nombres. El 9 y el 10 de octubre de 2026, Business Insider informó —y el medio de seguimiento de filtraciones TestingCatalog se hizo eco— que el personal del gigante de las búsquedas está probando internamente un checkpoint adicional de Gemini 4 llamado Carbon, que los primeros comentarios internos sitúan a Carbon como comparable a Claude Opus 5.5 para programar, que Barium-B es el checkpoint seleccionado para el lanzamiento público de Gemini 4 Argon, y que Carbon, probado a través de la plataforma interna Jetski de la empresa, es una iteración separada y posiblemente más potente. Lo que hace que valga la pena leer eso en lugar de hojearlo es la última cláusula: si Carbon se lanza como una actualización de Gemini 4 Argon o como un lanzamiento propio está, en palabras del propio informe, sin confirmar. Y ese es todo el estado de la evidencia — ningún anuncio, ningún identificador de modelo, ningún endpoint, ningún precio, ninguna ficha de modelo y ningún comentario del proveedor. Todo lo concreto en esta página es una filtración, una inferencia extraída de una filtración o un hecho sobre un modelo diferente y lanzable con el que se compara la filtración.

Lo que el informe afirma en realidad

La señal es tenue, y es lo suficientemente específica como para ser falsable, que es la única razón por la que pertenece a una página como esta. Despojadas del encuadre, las afirmaciones son estas:

• Los empleados de Google están probando internamente un checkpoint de Gemini 4 llamado Carbon. No es un modelo público y no se puede invocar desde ninguna API.

• Según se informa, los primeros comentarios internos sitúan a Carbon como comparable a Claude Opus 5.5 para programación —una impresión de las pruebas del personal, no un resultado de benchmark, y no una cifra que alguien fuera de Google pueda reproducir.

El checkpoint que está detrás del modelo del que el público realmente ha oído hablar —Gemini 4 Argon— se llama Barium-B, y a Carbon se lo describe como una iteración aparte y potencialmente más capaz, en lugar de la misma versión bajo dos etiquetas.

• Según se informa, Carbon se está ejercitando a través de Jetski, al que ese mismo informe describe como el nombre interno de Google asociado con Antigravity, su entorno de codificación agéntico.

• Se desconoce si Carbon se convertirá en una futura actualización Gemini 4 Argon o en un lanzamiento distinto de Gemini 4. Google no ha comentado nada al respecto.

Esa es la filtración. Contiene una comparación, una relación de nombre en clave y una pregunta genuinamente abierta, y ninguna de sus partes es un lanzamiento.

A two-column infographic titled 'Gemini 4 Carbon — what the report says / what it does not'. Left column 'What the report says': '9–10 Oct 2026 — Business Insider, relayed by TestingCatalog', 'Google staff testing a Gemini 4 checkpoint named Carbon', 'Early internal feedback: feels comparable to Claude Opus 5.5 for coding', 'Barium-B is the checkpoint chosen for the public Gemini 4 Argon release', 'Tested via Jetski, tied to Antigravity'. Right column 'What it does not say': 'Whether Carbon ships as an Argon update or a separate Gemini 4 release', 'No model ID, endpoint or price of any kind', 'No model card, context window or parameter count', 'No benchmark number behind the Opus 5.5 comparison', 'No date, and no comment from Google'. Footer: 'All leak claims unverified; Google has not commented.'

La escalera de nombres en clave, y qué peldaño importa

La razón por la que este informe necesita un anillo decodificador es que la costumbre de Google con la tabla periódica coloca tres nombres en un mismo párrafo que parecen paralelos y no lo son. Ordenados según lo que un lector puede hacer realmente con cada uno:

• Gemini 4 Argon — anunciado. Un nombre de modelo real con una publicación de anuncio de primera parte y una página de familia, un precio introductorio publicado de $2 por millón de tokens de entrada y $10 por millón de tokens de salida, un límite de salida publicado de 1 millón de tokens, y un despliegue restringido que comenzó con defensores cibernéticos verificados y se describió como una ampliación a clientes de API de pago a continuación. Todavía no tiene un identificador de modelo que puedas poner en una solicitud, que es la línea entre un modelo anunciado y uno invocable.

• Barium-B — un nombre de punto de control, no un producto. Según el mismo informe, es la compilación seleccionada para la versión pública de Argon. Eso es lo útil de la etiqueta: te dice que el nombre Argon es una decisión de lanzamiento envuelta alrededor de una compilación interna, más que una compilación en sí misma.

• Carbon — un punto de control interno con impresiones del personal adjuntas y nada más. Sin ID, sin precio, sin ventana, sin fecha. Es un rumor con un nombre en clave, y los nombres en clave son baratos.

Leído así, la historia no es «un nuevo Gemini filtrado». Es que Google parece estar ejecutando más de un checkpoint de frontera en paralelo, que aquel sobre el que puso su nombre público no es el que más entusiasma a sus ingenieros, y que nadie fuera de la empresa sabe cuál de esos dos hechos acabará importando.

Por qué "se siente como Claude Opus 5.5" es la frase que sostiene todo el argumento

De todo lo que hay en el informe, la comparación es la que más peso tiene y la menos verificable, así que vale la pena ser precisos sobre con qué se la está comparando. Claude Opus 5.5 es el buque insignia de Anthropic y, según mediciones independientes, el modelo de codificación más potente y ampliamente disponible de la generación actual — el punto de referencia al que recurre un ingeniero de Google cuando quiere decir "este es el bueno" sin nombrar un benchmark. Según su precio de lista publicado, cuesta $4.00 por millón de tokens de entrada y $20.00 por millón de tokens de salida, con lecturas de caché a $0.20 por millón, y tiene una ventana de entrada de 1M de tokens y una salida máxima de 128K tokens.

Frente a eso, la comparación dice dos cosas a la vez, y la segunda es la que la gente pasa por alto. La primera es competitiva: se describe un checkpoint interno de Google en la misma frase que el buque insignia del principal rival, lo cual es un cumplido que Google no pondría en una publicación de blog. La segunda es posicional: la comparación es una impresión de los empleados sobre la sensación al programar, que es exactamente el tipo de afirmación que sobrevive al contacto con una ventana de chat y muere al contacto con una tabla de clasificación. Nadie ha publicado un benchmark para Carbon. No hay entrada de Artificial Analysis, ni tabla de benchmarks del proveedor, ni PDF de metodología de evaluación: esos existen para Gemini 4 Argon y no existen para esto. Una sensación no es una puntuación, y esta página no va a disfrazar una como la otra.

También hay una consecuencia en el precio que vale la pena mencionar sin pretender conocer la respuesta. Si un checkpoint que «se siente como Claude Opus 5.5 para programar» está dentro de Google y el modelo que Google anunció realmente se sitúa cinco puntos por debajo de él en el índice independiente, entonces la pregunta interesante no es si Carbon es bueno — es a qué precio lo pondría Google, y si alguna vez se vendería a las tarifas de caballo de batalla a las que se ha lanzado el resto de la línea Gemini.

¿Qué falta, y por qué la lista es más larga que las noticias?

El honesto inventario de lo que no existe es todo el artículo, así que aquí está:

• Un identificador de modelo: Carbon no tiene ninguno, y Gemini 4 Argon tampoco. Ninguno de los dos nombres aparece en ningún lugar al que se pueda dirigir una solicitud.

• Un precio: nada publicado para Carbon en ningún nivel, ni siquiera una tarifa introductoria.

• Una ficha de modelo o una ficha de sistema — ninguna, y sin ninguna metodología de evaluación publicada que la respalde.

• Una ventana de contexto, un límite de salida o un número de parámetros — ninguno publicado, y Google no ha publicado un número de parámetros para ningún Gemini.

• Un resultado de benchmark — la comparación Opus 5.5 es una impresión de marca, lo que significa número, ninguna prueba y ninguna reproducibilidad.

• Una fecha — sin anuncio, sin despliegue por fases, sin ventana, y sin ningún comentario de Google sobre si se planea siquiera un lanzamiento de Carbon.

• Una relación —si Carbon es la próxima actualización de Argon o un modelo Gemini 4 independiente—. Esta es la incógnita más trascendental del informe y el propio informe la deja explícitamente sin confirmar.

Todo lo que no esté en esa lista es inferencia, incluida la mayor parte de lo que se escribirá sobre esto durante las próximas dos semanas.

Lo que un desarrollador puede hacer con esto hoy

La respuesta útil es que casi nada cambia, y vale la pena decir exactamente por qué. Ni Gemini 4 Argon ni Carbon están en OrcaRouter — consultar nuestro propio catálogo para cualquiera de los dos no devuelve nada, y seguirá sin devolver nada hasta que Google haga que uno de ellos se pueda invocar. El nombre Gemini 4 no es algo a lo que puedas enrutar; es un nombre asociado a un despliegue con acceso restringido. Cualquier cuenta que ofrezca acceso a "Gemini 4 Carbon" en este momento está vendiendo una etiqueta.

Lo que es real es el modelo con el que se mide la filtración. Claude Opus 5.5 ya está disponible en OrcaRouter al precio de lista de Anthropic — 4,00 $ de entrada y 20,00 $ de salida por millón de tokens, lecturas de caché a 0,20 $ por millón, transferido con cero margen — así que el modelo específico con el que se describe a Carbon como comparable es uno que puedes invocar hoy, con la misma clave de API que todo lo demás. Eso es un dato más útil que la filtración, porque es la mitad de la comparación que se puede probar.

La postura que sobrevive a un rumor es la que no necesita que el rumor sea cierto. Pon Claude Opus 5.5 detrás de tus cargas de trabajo de programación más difíciles y mantén una regla de conmutación por error hacia un nivel más económico para el tráfico que no lo necesita; el día en que aparezca un identificador real de Gemini 4 en el catálogo de un proveedor, nuestros precios de lista se actualizan el mismo día en que Google los fija, porque no hay ningún paso de renegociación entre que un proveedor publique un precio y nosotros lo traslademos. Una API para más de 200 modelos convierte "¿deberíamos migrar?" en una edición del DSL de enrutamiento y una prueba A/B sobre tráfico en vivo, en lugar de una reescritura. Enruta según resultados que puedas medir, no según nombres de los que leas.

A screenshot of Google's own Gemini API models documentation page, listing the Gemini 3.8 family and earlier models with their model codes and pricing, and containing no entry for Gemini 4 Argon or Gemini 4 Carbon.A screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, showing the model id, its capability chips, a 1M-token context window, a 128K maximum output, and pricing of .00 per 1M input tokens and 0.00 per 1M output tokens with cache reads at /bin/bash.20 per 1M.

Lo que estamos viendo.

• Si Google dice algo o no. Un comentario, un cambio en la página familiar, o una línea en una publicación de lanzamiento moverían todo esto fuera de la columna de filtraciones de una vez. El silencio lo mantiene donde está.

• La segunda etapa del despliegue de Argon. El anuncio describió a los clientes de pago de la API y a los suscriptores de Ultra como la siguiente cohorte después de los defensores verificados, y la llegada de un identificador de Gemini 4 es el acontecimiento que convierte «anunciado» en «invocable». Si llega a materializarse un endpoint ejecutable, la cuestión de si su checkpoint es Barium-B o algo más reciente se vuelve concreta.

• Cualquier medición independiente de Carbon. En el momento en que un checkpoint como este aparece en una tabla de clasificación neutral en lugar de en una impresión del personal, la frase de Opus 5.5 deja de ser una intuición y empieza a ser un dato — o deja de ser cierta.

• La hoja de precios. Dónde Google pone precio a un checkpoint de frontera que sus propios ingenieros prefieren es la señal reveladora de si Carbon es una actualización de Argon o un nivel propio.

• Si la relación de nombres en clave sobrevive al contacto con un lanzamiento. Barium-B detrás de Argon y Carbon a su lado es una historia limpia hoy; las publicaciones de lanzamiento tienen la costumbre de colapsar historias limpias en un solo modelo con un solo ID.

El resumen que no exagera esto es breve. Según los informes, el personal de Google está probando un checkpoint interno de Gemini 6 llamado {{1}}Carbon{{/1}}; su impresión inicial es que escribe código como {{2}}Claude Opus 5.5{{/2}}; el checkpoint detrás del lanzamiento público de {{3}}Gemini 4 Argon{{/3}} es otro distinto llamado {{4}}Barium-B{{/4}}; y no está confirmado si {{5}}Carbon{{/5}} llegará a convertirse alguna vez en un producto —una actualización, un modelo aparte o nada—. La mitad de esa frase sobre la que puedes actuar es la mitad que nombra a {{2}}Claude Opus 5.5{{/2}}, porque es el único modelo del párrafo con un identificador de modelo, un precio y un endpoint. Sigue llamando a lo que puedas llamar, y ten preparada una regla de conmutación por error para el día en que el otro nombre se convierta en uno.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario