Um cartão hero gerado intitulado Space Bunny Alpha, com um cartão arredondado centrado que lista os próprios números da listagem - janela de contexto de 1.000.000 de tokens, saída máxima de 524.288 tokens, $0 de entrada / $0 de saída por 1M de tokens, entrada de texto, imagem e vídeo, operador anônimo - e uma faixa com a inscrição 'Listagem stealth não reivindicada: sem pesos, sem fornecedor, sem benchmarks'. O logotipo OrcaRouter fica no canto inferior direito.
Guides & Insights

Space Bunny Alpha: um modelo anônimo gratuito de 1M tokens que ninguém reivindicou ainda

Autor

Rowan Sterling

Data de publicação

Modelos mais recentes · 20Ver todos os modelos →
Benchmarks: Artificial Analysis · atualizado diariamente
Voltar para todas as publicações

Space Bunny Alpha é um modelo anônimo que apareceu hoje, 23 de setembro de 2026, na plataforma de terceiros que hospeda prévias sigilosas: uma janela de contexto de 1.000.000 de tokens, uma saída máxima de 524.288 tokens, entrada de texto, imagem e vídeo, chamada de ferramentas, raciocínio obrigatório — e um preço de zero. Ninguém disse quem o construiu. Não há pesos publicados, nem contagem de parâmetros, nem licença, nem página do fornecedor e nem benchmark de qualquer tipo. Isto não é um lançamento, e nada neste texto deve ser lido como tal: é uma listagem, e o trabalho útil agora é ler a listagem com atenção.

Isso importa mais do que parece, porque o último modelo a aparecer dessa forma não permaneceu anônimo. Ox Alpha chegou na mesma plataforma em agosto, ficou gratuito por cerca de uma semana e acabou sendo o GLM-5.3-Flash da Z.ai — depois disso, deixou de ser gratuito. Space Bunny Alpha é a entrada mais recente em uma sequência que vem acontecendo o ano todo, e a sequência é a coisa mais confiável que temos para raciocinar enquanto a identidade é desconhecida.

O que o anúncio realmente diz

Tudo abaixo são os metadados do próprio anúncio, lidos hoje. São fornecidos pelo operador: o provedor anônimo os escreveu, e nenhum terceiro verificou qualquer parte deles.

• Janela de contexto — 1.000.000 de tokens. Mesma classe de 1M que o 1.048.576 anunciado do Ox Alpha.

• Saída máxima — 524.288 tokens. Quatro vezes o teto de 131.072 tokens anunciado pela listagem de agosto do Ox Alpha, e excepcionalmente grande para qualquer modelo, a qualquer preço.

• Entrada e saída — texto, imagem e vídeo na entrada; texto na saída. A entrada de vídeo tornou-se uma marca desta série; a maioria das listagens anônimas recentes a adotou.

• Preço — $0 por milhão de tokens de entrada e de saída. "Este modelo é gratuito para uso", nas palavras do anúncio.

• Raciocínio — obrigatório, não pode ser desativado, com uma escala de esforço de cinco níveis: baixo, médio, alto, xhigh, máximo, com padrão em médio. O padrão médio é uma mudança em relação ao padrão de esforço máximo que a listagem de agosto usava.

• Chamada de ferramentas — tools e tool_choice são aceitos. response_format fornece saída JSON, sem imposição de esquema JSON, que é a mesma ressalva de antes.

• Tratamento de dados — prompts e conclusões "podem ser retidos pelo provedor, mas não são usados para treinamento." Leia isso duas vezes; é uma declaração de retenção, não de retenção zero.

• Não divulgado — número de parâmetros, parâmetros ativos, arquitetura, família de tokenizador (a listagem diz apenas "Other"), data de corte de conhecimento, quantização, licença e se os pesos existem sequer.

A generated single-column scoreboard titled 'Space Bunny Alpha - the scoreboard', listing six rows: context window 1,000,000 tokens, max output 524,288 tokens, inputs text/image/video, price $0 in / $0 out per 1M, reasoning mandatory with five effort levels, and independent score 'none published'. A footer reads 'All figures are operator-supplied listing metadata, unaudited; no independent evaluation exists.' The OrcaRouter logo sits bottom-right.

O que o anúncio não diz

As ausências são mais informativas do que os números, porque estão exatamente onde os modelos anteriores se traíram.

Ox Alpha vazou sua própria identidade por meio de um tokenizador que correspondia à família GLM sonda por sonda, um codificador de vídeo cujo comportamento de token era idêntico ao de um modelo conhecido da Z.ai, e uma solicitação malformada que retornou um rastreamento de erro nomeando a própria rota de API do provedor. Nenhuma dessas evidências forenses existe para o Space Bunny Alpha ainda. Seu tokenizador está classificado como "Outro", seu corte de conhecimento é nulo, e ninguém publicou uma execução de impressão digital — então qualquer afirmação confiante sobre qual laboratório o construiu, incluindo qualquer uma que você leia esta semana, é um palpite vestindo as roupas da evidência.

A segunda ausência é a medição. Não há entrada na Artificial Analysis, nem classificação de arena, nem avaliação independente, nem qualquer execução de benchmark comunitário publicada por alguém. Para um modelo com um teto de saída de 524.288 tokens, esse é o número que um comprador mais gostaria de ver verificado — e o único que ninguém verificou: a coerência em saídas longas degrada-se muito antes de um teto nominal, e um teto não é uma capacidade.

O terceiro está operacional. O registro do endpoint não publica nenhuma taxa de transferência nem latência — ambos os campos estão vazios.

A única afirmação sobre a qual o anúncio se contradiz

A descrição chama o Space Bunny Alpha de um modelo grande anônimo “com inferência ultrarrápida”. Esse é o adjetivo do operador. O registro de endpoint da mesma listagem não informa velocidade de saída nem tempo até o primeiro token, e o tokenizador não é divulgado, portanto não há nada na página que sustente a palavra nem nada que a refute.

Vale a pena dar um nome a isso, porque é o modo de falha mais comum em listagens anônimas: adjetivos de velocidade são baratos de escrever e caros de verificar, e a entrada anterior desta série foi relatada por usuários iniciais como lenta para o primeiro token e instável sob carga, mesmo enquanto liderava os gráficos de uso. Trate "blazing-fast" como uma frase de marketing até que alguém publique tokens por segundo. Se você estiver avaliando este modelo, meça-o você mesmo na primeira chamada — throughput e latência do primeiro token são dois números que você consegue obter em cinco minutos, e eles lhe dirão mais sobre se ele se encaixa na sua carga de trabalho do que qualquer suposição de identidade.

A taxa base: cada um destes é reivindicado

Desde fevereiro de 2026, a plataforma vem executando uma sequência constante de listagens Alpha anônimas, e cada uma delas terminou com um laboratório identificado por trás:

• Pony Alpha (fevereiro) — GLM-5 da Z.ai, reivindicado em cerca de cinco dias.

• Hunter Alpha e Healer Alpha (11 de março) — MiMo-V2-Pro e MiMo-V2-Omni da Xiaomi.

• Elephant Alpha (abril) — Lingxi Ling-2.6-flash da Ant Group, anunciado cerca de duas semanas depois.

• Owl Alpha (Abril) — LongCat-2.0 da Meituan, confirmado em junho.

• Ox Alpha (20 de agosto) — GLM-5.3-Flash da Z.ai, revelado em 26 de agosto, com o período gratuito encerrando no mesmo momento.

• Union Alpha (16 de setembro) — agora listado ao lado de sua contraparte de nome, o Pareto da Unbiased.

Sete em sete, sobretudo laboratórios chineses, a maioria dentro de dias ou semanas. Isso é uma taxa-base, não uma previsão sobre Space Bunny Alpha — mas é a maneira honesta de enquadrar o palpite: se você está lendo isto enquanto a máscara ainda está posta, o resultado mais provável é que um laboratório o reivindique em breve, e o codinome não lhe dá nenhuma informação sobre qual deles. A convenção de nomenclatura com animais e Alpha nunca se correlacionou com o fornecedor.

O padrão carrega um detalhe acionável. A janela gratuita do Ox Alpha durou cerca de seis dias e fechou na revelação. O acesso gratuito nesta série tem sido um instrumento de prévia, não um nível permanente — então, se você quer saber no que o Space Bunny Alpha é bom nos seus próprios prompts, o momento barato de descobrir é agora, enquanto o preço é zero e a fila está curta.

Experimentar um modelo não comprovado sem apostar a produção nele

Nada em uma listagem anônima impede você de avaliá-la; o que ela deve impedir é que você a coloque em um caminho que você não pode se dar ao luxo de ver quebrar. Duas regras decorrem da própria listagem.

• Não envie a ele nada que você não entregaria a um estranho. A listagem diz que prompts e completions podem ser retidos pelo provedor. Isso exclui código-fonte proprietário, dados de clientes e qualquer coisa sujeita a um regime de conformidade. Prompts de benchmark públicos, código aberto e protótipos descartáveis são aceitáveis.

• Não o torne o único modelo em um caminho. Um fornecedor sem nome, sem página de status e sem latência publicada é um fornecedor cujas falhas você não consegue escalar.

Essa segunda regra é aquilo para que serve o failover, e é a parte em que podemos realmente ajudar. O OrcaRouter disponibiliza mais de 200 modelos através de uma única API sem markup sobre o preço de tabela do fornecedor — paga a tarifa do próprio fornecedor, por isso um corte de preço de um fornecedor fica ativo do nosso lado no mesmo dia — e failover automático entre fornecedores. A DSL de routing permite declarar um modelo comprovadamente bom como fallback de um experimental, para que uma pré-visualização anónima possa absorver o tráfego de uma carga de trabalho real sem ser um ponto único de falha. O Space Bunny Alpha não está no nosso catálogo hoje, por isso não somos uma forma de chamar este modelo específico; somos a forma de manter um modelo medido por trás dele enquanto descobre se o anónimo merece o tráfego. O último Alpha anónimo é um exemplo útil do que parece a ponta final desse pipeline: o GLM-5.3-Flash é encaminhável no OrcaRouter à sua tarifa publicada, e as suas pontuações independentes são públicas.

A headless Chromium screenshot of OrcaRouter's own model catalogue page, showing the 'Model catalogue' heading, the line '200+ models behind a single API', the promise '0% markup - you pay the provider's published rate', filter chips, and a model table with columns Model / Context / Input / Output / Modalities listing Claude Opus 5.2, GPT-6 Sol, GPT-6 Luna, Gemini 3.1 Pro, Grok 5, DeepSeek-V4.1-Flash, GLM-5.3-Flash, Kimi K2.5, Qwen3.8-Max, Llama 4.5, Mistral Large 3 and Command A+, above lower-page blocks for Pricing & availability, Automatic failover, Routing DSL and Model fusion.

O que resolveria isso

Três coisas, em ordem aproximada de probabilidade.

Primeiro, perícia de tokenizador e de caminhos de erro. A comunidade descobriu a identidade do Ox Alpha em menos de uma semana com sondagens que qualquer desenvolvedor pode executar; o mesmo método se aplica aqui e ainda não foi publicado. Essa é a rota mais rápida de "anônimo" para "provavelmente desta família".

Segundo, um benchmark independente. Uma única execução completa em uma suíte pública — não um teste rápido de dez perguntas, que foi como o último modelo anônimo adquiriu brevemente uma pontuação de 80% em programação que uma nova execução completa de 113 tarefas reduziu para cerca de 63% — seria a primeira evidência real sobre a qualidade. Enquanto isso não existir, a única alegação de qualidade em circulação é a descrição do próprio operador.

Terceiro, a própria revelação, que nesta série chegou com um nome, uma licença, um número de parâmetros e uma mudança de preço, tudo de uma vez. Quando isso acontecer, as perguntas que decidem se o Space Bunny Alpha importa são nada glamourosas: os pesos são abertos, quanto custa por milhão de tokens depois da janela gratuita, e mantém a qualidade ao longo dos comprimentos de saída que o seu teto anuncia.

A generated two-column infographic titled 'Space Bunny Alpha - known vs unknown'. The left card, headed 'Disclosed by the operator', lists Context: 1,000,000 tokens, Max output: 524,288 tokens, Inputs: text, image, video, Price: free, $0 per 1M. The right card, headed 'Not disclosed', lists Vendor: anonymous, Parameter count: none, Tokenizer: filed as Other, Benchmarks: none published. A footer reads 'Operator-supplied listing metadata, unaudited; no independent evaluation exists.' The OrcaRouter logo sits bottom-right.

Por ora, a postura correta é a que a própria listagem implica. Uma janela gratuita de 1.000.000 de tokens, 524.288 tokens de saída, entrada de vídeo e chamada de ferramentas é algo genuinamente interessante de se ter em uma chave — e uma coisa genuinamente ruim de se ter em um caminho crítico, vinda de um provedor que não lhe disse nada sobre si mesmo, exceto que gostaria que você acreditasse que ele é rápido. Experimente com seus próprios prompts esta semana, mantenha um modelo medido por trás dele e trate toda alegação de identidade que você ler até lá como não verificada. Isso não é cautela por si só; é a única leitura que as evidências sustentam.