Um cartão de título hero para o Ox Alpha, o modelo de fronteira anônimo, mostrando um chip de modelo em forma de ponto de interrogação com entradas de texto, imagem e vídeo fluindo para dentro e blocos de tokens fluindo para fora, com três pílulas com os textos 'Contexto de 1M de tokens', 'Grátis por uma semana' e 'Fabricante desconhecido', e o logotipo da OrcaRouter composto no canto inferior direito.
Guides & Insights

Ox Alpha: O Modelo de Fronteira Anônimo que Está Grátis por uma Semana — e Ninguém Dirá Quem o Criou

Autor

Magnus Corvin

Data de publicação

Modelos mais recentes · 20Ver todos os modelos
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Em 20 de agosto, um modelo de fronteira anônimo chamado Ox Alpha apareceu em uma plataforma de API de IA de terceiros com uma janela de contexto de 1 milhão de tokens, entrada de texto/imagem/vídeo e preço zero. Ninguém disse quem o construiu — e esse silêncio é, por si só, a história. Todos os últimos quatro modelos lançados da mesma forma anônima acabaram sendo reivindicados por laboratórios chineses: o GLM-5 da Zhipu AI, o MiMo-V2-Pro da Xiaomi, o Lingxi Ling-2.6-flash do Ant Group e o LongCat-2.0 da Meituan. O Ox Alpha, listado sob o ID stealth/ox-alpha, é o quinto lançamento dessa série. Ele está gratuito pela próxima semana e, seguindo o padrão dos quatro anteriores, a revelação geralmente chega rápido.

Cada número neste artigo é uma afirmação do próprio operador, um dado da listagem da própria plataforma ou um anúncio público — ainda não existem benchmarks independentes, e nada aqui deve ser confundido com um.

O que sabemos — e o que não sabemos

A versão rápida:

• O operador descreve o Ox Alpha como "um modelo de fronteira construído para codificação eficiente, trabalho agêntico sustentado e uso em produção no mundo real" — um modelo de raciocínio voltado para engenharia de software de longo horizonte e fluxos de trabalho que combinam texto com contexto visual.

• Tem uma janela de contexto de 1.048.576 tokens (1M), um limite de saída de 131.072 tokens e aceita entrada de texto, imagem e vídeo — o primeiro dos lançamentos anônimos a anunciar entrada de vídeo.

• É gratuito por uma semana: US$ 0 por milhão de tokens de entrada e saída, com o operador afirmando "limites de taxa generosos, uso quase ilimitado" e capacidade de servir 100 trilhões de tokens por dia.

• Os dados de atividade inicial na plataforma já mostram tráfego de produção real, incluindo um agente de codificação da Nous Research e o editor Zed.

• Nenhuma empresa o reivindicou até 21 de agosto, não há pontuações de benchmark de nenhum tipo, o preço real após a semana gratuita é desconhecido, e a arquitetura do modelo e a contagem de parâmetros não são divulgadas.

O que é Ox Alpha

A descrição da plataforma apresenta o Ox Alpha como "um modelo de raciocínio projetado para codificação, trabalho agêntico contínuo e cargas de trabalho de produção — engenharia de software de longo horizonte, raciocínio complexo e fluxos de trabalho que combinam texto com contexto visual." Esse é um posicionamento específico: ele é construído para loops agênticos de longa duração e para código, não para chat geral. O contexto de 1M é a pista reveladora — espaço suficiente para uma sessão de agente de várias horas ou um repositório grande — e o limite de saída de 131K permite gerações únicas longas. Ele suporta chamada de ferramentas e funções e saída JSON estruturada, que é o restante do checklist agêntico.

A single-column scoreboard for Ox Alpha listing: context window 1M (1,048,576) tokens, max output 131,072 tokens, input text/image/video, independent benchmarks none yet, price free for one week, throughput 56 tokens/s (P50, platform-measured), with a footer reading 'Operator + platform-reported; no independent scores yet', and the OrcaRouter logo in the bottom-right corner.

A entrada de vídeo é o item mais distintivo da ficha. Nenhum dos modelos anônimos anteriores o anunciava, e um modelo que aceita quadros de vídeo, além de texto e imagens, é voltado para uma classe de carga de trabalho diferente dos lançamentos otimizados para chat que o precederam. Tudo isso — a descrição, as especificações, os números de velocidade — vem do operador e da listagem da plataforma. Nada disso é verificado de forma independente.

A oferta grátis por uma semana

A promoção é agressiva. Grátis na próxima semana, "limites de taxa generosos, uso quase ilimitado", e uma capacidade reivindicada de 100 trilhões de tokens por dia, com a nota do operador convidando os usuários a "ver o que você consegue fazer". Literalmente, 100T tokens por dia colocariam este operador entre os maiores provedores de inferência do mundo — a alegação parece menos uma especificação e mais um desafio de teste de estresse, o que se encaixa no padrão: lançamentos anônimos são assim que um laboratório obtém tráfego real em escala de fronteira sem colocar seu nome na porta.

O outro lado de "grátis por uma semana" é que não há preço conhecido após a semana. Os modelos anônimos anteriores ou permaneceram gratuitos ou foram incorporados à sua revelação posteriormente; a janela gratuita do Ox Alpha cria um prazo, e o número real pode chegar a qualquer valor. Essa é a principal razão para não projetar um orçamento de produção em torno do atual $0.

Ainda sem benchmarks — mas já tráfego real

A listagem da Ox Alpha não possui dados de benchmark: nenhum índice de inteligência, nenhuma pontuação de codificação, nenhuma pontuação agêntica, e não aparece em leaderboards independentes como o Artificial Analysis. A palavra "frontier" é do próprio operador, e ainda não há evidências verificadas de quão bom o modelo realmente é.

A screenshot of the Artificial Analysis models leaderboard as of August 21, 2026, showing the Intelligence section led by Claude Opus 5 and Claude Fable 5, the largest context-window highlights, and the output-speed rankings — a frontier leaderboard Ox Alpha has no independent score on yet.

O que existe é o uso. Os dados de atividade da plataforma mostram tráfego real de produção já nas primeiras horas — incluindo o Hermes Agent, o projeto de codificação agêntica da Nous Research, e o editor Zed. Ambos são exatamente os casos de uso de "trabalho agêntico sustentado e codificação" para os quais o modelo é posicionado. Não é uma pontuação, mas é um sinal: desenvolvedores com cargas de trabalho reais decidiram que uma aposta gratuita, de classe de fronteira e anônima valia a pena ser conectada. Para um modelo com zero benchmarks publicados, essa adoção inicial é a única evidência que existe.

As letras miúdas da retenção de dados

O anúncio da semana gratuita promove "retenção zero de dados". A listagem do modelo na plataforma conta uma história mais matizada: prompts e completions são retidos pelo provedor, mas não são usados para treinamento, sob os termos do modelo furtivo da plataforma. A diferença importa se você estiver prestes a colar código proprietário em uma janela de 1M de tokens pertencente a um operador anônimo. Trate "retenção zero de dados" como marketing até que o operador publique termos que o digam em palavras diretas — e encaminhe qualquer coisa que você não queira que seja registrada através de um modelo separado e atribuível.

O manual do modelo anônimo

Ox Alpha é o quinto lançamento anônimo em seis meses, e os quatro anteriores se resolveram da mesma forma — uma estreia anônima, uma onda de tráfego gratuito, e então uma empresa se apresentando:

• Pony Alpha (fevereiro de 2026) — confirmado pela Zhipu AI cerca de cinco dias após o lançamento como GLM-5, seu carro-chefe MoE de 744B parâmetros.

• Hunter Alpha (11 de março) — um modelo gratuito de trilhão de parâmetros com contexto de 1M que se tornou a história especulativa da primavera, amplamente cogitado como DeepSeek V4; revelado como MiMo-V2-Pro da Xiaomi, com o companheiro Healer Alpha identificado como MiMo-V2-Omni.

• Elephant Alpha (abril) — um modelo de texto gratuito, focado em eficiência, que a Ant Group afirmou ser o Lingxi Ling-2.6-flash cerca de duas semanas depois de ele aparecer.

{{1}}Owl Alpha (final de abril) — um modelo focado em agentes com chamada nativa de ferramentas e um contexto de ~1M que a Meituan confirmou como LongCat-2.0 em 30 de junho, o primeiro modelo com trilhão de parâmetros treinado e servido inteiramente em chips chineses domésticos.{{/1}}

• Ox Alpha (20 de agosto) — não reivindicado até o momento desta escrita.

A two-column scorecard titled 'The anonymous models — and their reveals', listing Pony Alpha revealed as GLM-5 by Zhipu AI, Hunter Alpha as MiMo-V2-Pro by Xiaomi, Elephant Alpha as Lingxi Ling-2.6-flash by Ant Group, Owl Alpha as LongCat-2.0 by Meituan, and Ox Alpha marked '??? — unclaimed', with a footer noting reveals per each lab's public announcement and Ox Alpha unclaimed as of August 21, 2026, and the OrcaRouter logo in the bottom-right corner.

Por que lançar um bom modelo atrás de uma máscara? A leitura padrão, que o ciclo Hunter Alpha tornou concreta, é que o anonimato remove o viés de marca das avaliações, e o uso gratuito gera dados de avaliação do mundo real via crowdsourcing em escala de fronteira enquanto todos discutem sobre o dono. Como uma análise do padrão disse: "a falta de uma marca é o marketing." A vantagem extra é a velocidade: um modelo anônimo pode alcançar uma audiência global de desenvolvedores em horas, sem um evento de lançamento, e o próprio mistério se torna a distribuição.

Quem é Ox Alpha?

Ninguém reivindicou a autoria, e ainda não há evidências concretas. O que existe é um prior: quatro de quatro lançamentos anônimos resolvidos acabaram sendo de laboratórios chineses, e o perfil do Ox Alpha se encaixa no mesmo padrão — um modelo de raciocínio focado em codificação e agentes, com contexto de 1M e uma alegação confiante de capacidade é exatamente o tipo de coisa que um grande fornecedor lança para testar sua stack de serving em escala.

O sinal distintivo é a entrada de vídeo, que nenhum dos modelos anônimos anteriores divulgou; isso restringe o campo para laboratórios com trabalho sério em multimodalidade e vídeo. Mas uma crença prévia não é evidência, e esta versão difere das anteriores em um aspecto digno de nota: o operador está afirmando uma postura de não retenção, enquanto modelos anônimos anteriores foram explícitos em coletar seus dados. Se isso se confirmar, o motivo muda de coleta de dados para puro teste de escala ou posicionamento pré-lançamento. Até que uma empresa se apresente — ou o modelo revele uma pista de arquitetura — todo palpite é apenas um palpite.

Você deveria desenvolver isso esta semana?

Esta semana não custa nada além do tempo de integração. Se você faz trabalho agêntico de horizonte longo, escreve código em contextos longos ou executa pipelines com uso intenso de vídeo, essa é exatamente a interseção onde a Ox Alpha está posicionada — e a janela gratuita é o momento certo para descobrir se o posicionamento é real. Dois cuidados. Primeiro, não há evidência independente de que seja de classe de fronteira; o rótulo "fronteira" é uma afirmação. Segundo, não há garantia de que o nível gratuito — ou o modelo — sobreviva à semana. Essa é a forma de um teste, não de uma dependência.

A maneira segura para produção de executar um teste assim é uma cadeia de fallback: o modelo experimental responde quando está saudável, e a solicitação é direcionada a um modelo comprovado no momento em que ele trava, apresenta erro ou desaparece. É para isso que serve uma camada de roteamento. Uma única API para mais de 200 modelos, failover automático para que o tráfego da semana gratuita de lançamento de um modelo anônimo não se torne a sua indisponibilidade, e margem de 0% — preço de tabela do provedor repassado — para que, quando o preço real do Ox Alpha aparecer após a semana gratuita, o número que você vê seja o número que você paga, no mesmo dia em que o operador o alterar. Use a semana gratuita para testar; decida após a revelação.

O que assistir

Quatro coisas contarão a história. A revelação: modelos anônimos anteriores foram reivindicados dias ou semanas após o lançamento, e quando uma empresa se apresenta, a página do modelo o nomeará. O preço: o que quer que substitua o nível gratuito, e se um nível gratuito sobrevive. Os primeiros benchmarks independentes: uma entrada no Artificial Analysis ou LMArena resolveria se "fronteira" é fato ou slogan. E a capacidade: se os alegados 100T tokens/dia se sustentam sob carga real.

O veredito honesto: Ox Alpha é um experimento excepcionalmente barato nas duas direções. A plataforma testa se um modelo anônimo de classe frontier, a $0, consegue ganhar tráfego real de produção em uma semana; você testa se o modelo merece esse tráfego. Rode o experimento, mas rode com um fallback por baixo. Quando a semana gratuita terminar, é bem provável que saibamos quem o fez, quanto custa e se ele conquistou um lugar na sua stack — e essas três respostas são o que fazem a audição valer a pena.

© 2026 OrcaRouter

Para provedores

Opera uma plataforma de inferência? Traga seus modelos para o OrcaRouter.

providers@orcarouter.ai

Junte-se à comunidade

Discordsupport@orcarouter.aiXGitHubYouTube