
Space Bunny Alpha : un modèle anonyme gratuit de 1 million de tokens que personne n’a encore revendiqué
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 301 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 195 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Space Bunny Alpha est un modèle anonyme apparu aujourd'hui, le 23 septembre 2026, sur la plateforme tierce qui héberge des aperçus furtifs : une fenêtre de contexte de 1 000 000 de tokens, une sortie maximale de 524 288 tokens, des entrées texte, image et vidéo, l'appel d'outils, un raisonnement obligatoire — et un prix de zéro. Personne n'a dit qui l'a construit. Il n'y a aucun poids publié, aucun nombre de paramètres, aucune licence, aucune page de fournisseur et aucun benchmark d'aucune sorte. Il ne s'agit pas d'une sortie, et rien dans ce texte ne doit être lu comme telle : c'est une fiche, et le travail utile à l'heure actuelle consiste à lire attentivement la fiche.
Cela compte plus que ça n'en a l'air, car le dernier modèle à apparaître de cette façon n'est pas resté anonyme. Ox Alpha est arrivé sur la même plateforme en août, a été gratuit pendant environ une semaine, et s'est avéré être GLM-5.3-Flash de Z.ai — après quoi il n'était plus gratuit. Space Bunny Alpha est la dernière entrée d'une séquence qui s'est poursuivie toute l'année, et cette séquence est la chose la plus fiable dont nous disposons pour raisonner tant que l'identité est inconnue.
Ce que l'annonce dit réellement
Tout ce qui suit provient des métadonnées de l’annonce elle-même, lues aujourd’hui. Elles sont fournies par l’opérateur : le fournisseur anonyme les a rédigées, et aucun tiers ne les a vérifiées.
• Fenêtre de contexte — 1 000 000 de tokens. Même classe de 1 M que le 1 048 576 annoncé par Ox Alpha.
• Sortie maximale — 524 288 tokens. Quatre fois le plafond de 131 072 tokens annoncé dans la fiche d’août d’Ox Alpha, et d’une taille inhabituellement élevée pour n’importe quel modèle, à n’importe quel prix.
• Entrée et sortie — texte, image et vidéo en entrée ; texte en sortie. L’entrée vidéo est devenue une signature de cette série ; la plupart des annonces anonymes récentes l’ont adoptée.
• Prix — 0 $ par million de tokens en entrée et en sortie. « Ce modèle est gratuit à l'utilisation », selon les termes de l'annonce.
• Raisonnement — obligatoire, ne peut pas être désactivé, avec une échelle d'effort en cinq niveaux : low, medium, high, xhigh, max, la valeur par défaut étant medium. Un défaut à medium constitue un changement par rapport au défaut max-effort utilisé dans la liste d'août.
• Appel d'outils — tools et tool_choice sont acceptés. response_format produit une sortie JSON, sans application du schéma JSON, ce qui présente la même réserve que précédemment.
• Gestion des données — les prompts et les complétions « peuvent être conservés par le fournisseur, mais ne sont pas utilisés pour l’entraînement ». Relisez-le deux fois ; il s’agit d’une déclaration de rétention, pas d’une déclaration de rétention zéro.
• Non divulgué — nombre de paramètres, paramètres actifs, architecture, famille de tokenizer (la fiche indique seulement "Other"), date de coupure des connaissances, quantification, licence, et si les poids existent tout court.

Ce que l'annonce ne dit pas
Les absences sont plus instructives que les chiffres, car elles sont exactement là où les modèles précédents se sont trahis.
Ox Alpha a divulgué sa propre identité via un tokenizer qui correspondait à la famille GLM sonde par sonde, un encodeur vidéo dont le comportement des tokens était identique à celui d’un modèle Z.ai connu, et une requête mal formée qui a renvoyé une trace d’erreur nommant la propre route API du fournisseur. Aucune de ces analyses techniques n’existe encore pour Space Bunny Alpha. Son tokenizer est classé dans « Autre », sa date limite de connaissances est nulle, et personne n’a publié d’analyse d’empreinte — donc toute affirmation assurée sur le laboratoire qui l’a construit, y compris celles que vous lisez cette semaine, est une supposition déguisée en preuve.
La deuxième absence est la mesure. Il n’existe aucune fiche Artificial Analysis, aucune note d’arène, aucune évaluation indépendante et aucune exécution de benchmark communautaire que quiconque ait publiée. Pour un modèle avec un plafond de sortie de 524 288 jetons, c’est le chiffre qu’un acheteur voudrait le plus voir vérifié et celui que personne n’a vérifié : la cohérence des sorties longues se dégrade bien avant un plafond nominal, et un plafond n’est pas une capacité.
Le troisième est opérationnel. L'enregistrement du point de terminaison ne publie ni débit ni latence — les deux champs sont vides.
La seule affirmation sur laquelle l'annonce se contredit
La description qualifie Space Bunny Alpha de grand modèle anonyme « avec une inférence ultra-rapide ». C'est l'adjectif de l'opérateur. L'enregistrement du point de terminaison de la même annonce n'indique ni vitesse de sortie ni temps jusqu'au premier token, et le tokenizer n'est pas divulgué, de sorte que rien sur la page n'étaye ce mot, et rien ne le réfute non plus.
Cela vaut la peine de le nommer car il s'agit du mode de défaillance le plus courant dans les annonces anonymes : les adjectifs de vitesse sont bon marché à écrire et chers à vérifier, et l'entrée précédente de cette série a été signalée par les premiers utilisateurs comme lente au premier token et instable sous charge, alors même qu'elle dominait les classements d'utilisation. Considérez « blazing-fast » comme un slogan marketing jusqu'à ce que quelqu'un publie des tokens par seconde. Si vous évaluez ce modèle, mesurez-le vous-même dès le premier appel — le débit et la latence du premier token sont deux chiffres que vous pouvez obtenir en cinq minutes, et ils vous en diront plus sur son adéquation à votre charge de travail que toute supposition sur son identité.
Le taux de base : chacun d’entre eux est réclamé.
Depuis février 2026, la plateforme a enchaîné une série régulière de référencements Alpha anonymes, et chacun d’eux, sans exception, s’est conclu par l’implication d’un laboratoire nommé :
• Pony Alpha (février) — le GLM-5 de Z.ai, revendiqué en cinq jours environ.
• Hunter Alpha et Healer Alpha (11 mars) — les MiMo-V2-Pro et MiMo-V2-Omni de Xiaomi.
• Elephant Alpha (avril) — Lingxi Ling-2.6-flash d'Ant Group, annoncé environ deux semaines plus tard.
• Owl Alpha (avril) — le LongCat-2.0 de Meituan, confirmé en juin.
• Ox Alpha (20 août) — GLM-5.3-Flash de Z.ai, dévoilé le 26 août, la fenêtre gratuite se refermant au même moment.
• Union Alpha (16 septembre) — désormais répertorié aux côtés de son homologue nommé, le Pareto d’Unbiased.
Sept sur sept, majoritairement des laboratoires chinois, majoritairement en quelques jours à quelques semaines. C’est un taux de base, pas une prédiction concernant Space Bunny Alpha — mais c’est la façon honnête de formuler l’hypothèse : si vous lisez ceci alors que le masque est encore en place, l’issue la plus probable est qu’un laboratoire le revendique bientôt, et le nom de code ne vous donne aucune information sur lequel. La convention de nommage animal-et-Alpha n’a jamais été corrélée au fournisseur.
Le schéma comporte un détail exploitable. La fenêtre gratuite d’Ox Alpha a duré environ six jours et s’est refermée lors de la révélation. L’accès gratuit dans cette série a été un outil de prévisualisation, pas un palier permanent — donc si vous voulez savoir ce que Space Bunny Alpha sait bien faire sur vos propres prompts, le moment peu coûteux pour le découvrir, c’est maintenant, tant que le prix est à zéro et que la file d’attente est courte.
Essayer un modèle non éprouvé sans parier la production dessus
Rien dans une annonce anonyme ne vous empêche de l’évaluer ; ce qu’elle devrait vous empêcher de faire, c’est de la placer sur une voie dont vous ne pouvez pas vous permettre qu’elle se brise. Deux règles découlent de l’annonce elle-même.
• Ne lui envoyez rien que vous ne remettriez pas à un inconnu. La fiche indique que les prompts et les complétions peuvent être conservés par le fournisseur. Cela exclut le code source propriétaire, les données clients et tout ce qui relève d’un régime de conformité. Les prompts de benchmarks publics, le code open source et les prototypes jetables conviennent.
• N'en faites pas le seul modèle d'un chemin. Un fournisseur sans nom, sans page de statut et sans latence publiée est un fournisseur dont vous ne pouvez pas faire remonter les défaillances.
Cette deuxième règle, c'est précisément à quoi sert le basculement automatique, et c'est la partie pour laquelle nous pouvons réellement vous aider. OrcaRouter sert plus de 200 modèles derrière une seule API sans marge sur le prix catalogue du fournisseur — vous payez le tarif propre au fournisseur, donc une baisse de prix côté fournisseur est effective chez nous le jour même — et un basculement automatique entre fournisseurs. Le DSL de routage vous permet de déclarer un modèle éprouvé comme solution de repli pour un modèle expérimental, afin qu'un aperçu anonyme puisse absorber le trafic d'une charge de travail réelle sans constituer un point de défaillance unique. Space Bunny Alpha ne figure pas dans notre catalogue aujourd'hui, nous ne sommes donc pas un moyen d'appeler ce modèle précis ; nous sommes le moyen de garder un modèle mesuré derrière lui pendant que vous déterminez si l'anonyme mérite ce trafic. Le dernier Alpha anonyme est un bon exemple de ce à quoi ressemble l'autre bout de ce pipeline : GLM-5.3-Flash est routable sur OrcaRouter à son tarif publié, et ses scores indépendants sont publics.

Qu'est-ce qui réglerait ça ?
Trois choses, dans un ordre approximatif de probabilité.
D'abord, l'analyse du tokeniseur et des chemins d'erreur. La communauté a découvert l'identité d'Ox Alpha en moins d'une semaine grâce à des sondes que tout développeur peut exécuter ; la même méthode s'applique ici et n'a pas encore été publiée. C'est la voie la plus rapide de « anonyme » à « probablement cette famille ».
Deuxièmement, un benchmark indépendant. Une seule exécution complète sur une suite publique — et non un test de fumée de dix questions, c’est ainsi que le dernier modèle anonyme a brièvement obtenu un score de codage de 80 %, qu’une nouvelle exécution complète de 113 tâches a fait retomber à environ 63 % — constituerait la première véritable preuve de qualité. Tant que cela n’existe pas, la seule revendication de qualité en circulation est la description donnée par l’opérateur lui-même.
Troisièmement, la révélation elle-même, qui dans cette série est arrivée avec un nom, une licence, un nombre de paramètres et un changement de prix, tout à la fois. Le moment venu, les questions qui déterminent si Space Bunny Alpha compte sont peu glamour : les poids sont-ils ouverts, combien coûte-t-il par million de tokens après la fenêtre gratuite, et maintient-il la qualité sur les longueurs de sortie que son plafond annonce.

Pour l’instant, la bonne posture est celle que la fiche elle-même implique. Une fenêtre gratuite de 1 000 000 de tokens, 524 288 tokens de sortie, l’entrée vidéo et l’appel d’outils sont des choses réellement intéressantes à avoir sur une clé — et une chose réellement mauvaise à avoir sur un chemin critique, de la part d’un fournisseur qui ne vous a rien dit de lui-même, si ce n’est qu’il aimerait que vous croyiez qu’il est rapide. Essayez-le cette semaine sur vos propres prompts, gardez en soutien un modèle dont vous avez mesuré les performances, et considérez toute affirmation d’identité que vous lirez d’ici là comme non vérifiée. Ce n’est pas de la prudence pour la prudence ; c’est la seule interprétation que les preuves étayent.
