Une carte de titre hero pour Ox Alpha, le modèle frontalier anonyme, montrant une puce de modèle en forme de point d’interrogation avec des entrées de texte, d’image et de vidéo affluant et des blocs de jetons sortant, avec trois pastilles indiquant « Contexte de 1M jetons », « Gratuit pendant une semaine » et « Créateur inconnu », et le logo OrcaRouter incrusté dans le coin inférieur droit.
Guides & Insights

Ox Alpha : le modèle de pointe anonyme gratuit pendant une semaine — et personne ne dira qui l'a créé.

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le 20 août, un modèle de pointe anonyme appelé Ox Alpha est apparu sur une plateforme d'API IA tierce avec une fenêtre de contexte d'un million de jetons, une entrée texte/image/vidéo et un prix de zéro. Personne n'a dit qui l'a construit — et ce silence est en soi l'histoire. Les quatre derniers modèles publiés de manière tout aussi anonyme ont tous été finalement revendiqués par des laboratoires chinois : le modèle de Zhipu AI, GLM-5, celui de Xiaomi, MiMo-V2-Pro, celui d'Ant Group, Lingxi Ling-2.6-flash, et celui de Meituan, LongCat-2.0. Ox Alpha, listé sous l'identifiant stealth/ox-alpha, est la cinquième entrée de cette série. Il est gratuit pour la prochaine semaine, et selon le schéma des quatre précédents, la révélation arrive généralement vite.

Chaque chiffre mentionné dans cet article est une affirmation de l'opérateur lui-même, une donnée issue de la propre fiche de la plateforme ou une annonce publique — il n'existe pas encore de benchmarks indépendants, et rien ici ne doit être pris pour tel.

Ce que nous savons — et ce que nous ne savons pas.

La version rapide :

L'opérateur décrit Ox Alpha comme « un modèle de pointe conçu pour un codage efficace, un travail agentique soutenu et une utilisation en production réelle » — un modèle de raisonnement destiné à l'ingénierie logicielle à long horizon et aux flux de travail qui combinent texte et contexte visuel.

Il dispose d'une fenêtre de contexte de 1 048 576 jetons (1 M), d'une limite de sortie de 131 072 jetons, et accepte des entrées textuelles, images et vidéo — la première des versions anonymes à annoncer une entrée vidéo.

• C'est gratuit pendant une semaine : 0 $ par million de jetons en entrée et en sortie, l'opérateur affirmant proposer « des limites de débit généreuses, une utilisation quasi illimitée » et une capacité de service de 100 000 milliards de jetons par jour.

• Les premières données d'activité sur la plateforme montrent déjà un trafic de production réel, notamment un agent de codage de Nous Research et l'éditeur Zed.

• Aucune entreprise ne l'a revendiqué au 21 août, il n'existe aucun score de référence d'aucune sorte, le prix réel après la semaine gratuite est inconnu, et l'architecture du modèle ainsi que le nombre de paramètres ne sont pas divulgués.

Ce qu'est Ox Alpha

La description de la plateforme présente Ox Alpha comme « un modèle de raisonnement conçu pour le codage, le travail agentique soutenu et les charges de travail de production — ingénierie logicielle à long horizon, raisonnement complexe et flux de travail combinant texte et contexte visuel ». C'est un positionnement spécifique : il est conçu pour les boucles d'agents de longue durée et pour le code, et non pour la conversation générale. Le contexte de 1M est l'indice révélateur — c'est suffisamment d'espace pour une session d'agent de plusieurs heures ou un grand dépôt — et la limite de sortie de 131K permet de longues générations en une seule fois. Il prend en charge l'appel d'outils et de fonctions ainsi que la sortie JSON structurée, ce qui constitue le reste de la checklist agentique.

A single-column scoreboard for Ox Alpha listing: context window 1M (1,048,576) tokens, max output 131,072 tokens, input text/image/video, independent benchmarks none yet, price free for one week, throughput 56 tokens/s (P50, platform-measured), with a footer reading 'Operator + platform-reported; no independent scores yet', and the OrcaRouter logo in the bottom-right corner.

L'entrée vidéo est l'élément le plus distinctif de la fiche. Aucun des modèles anonymes précédents ne la proposait, et un modèle capable de traiter des images vidéo ainsi que du texte et des images vise une classe de charge de travail différente de celle des versions optimisées pour le chat qui l'ont précédé. Tout cela — la description, les spécifications, les chiffres de vitesse — provient de l'opérateur et de la fiche de la plateforme. Rien de tout cela n'est vérifié indépendamment.

L'offre gratuite pendant une semaine

La promotion est agressive. Gratuit pendant la semaine à venir, « limites de débit généreuses, utilisation quasi illimitée », et une capacité annoncée de 100 000 milliards de jetons par jour, avec une note de l'opérateur invitant les utilisateurs : « Voyez ce que vous pouvez faire ». Prise au pied de la lettre, cette capacité de 100 T de jetons par jour placerait l'opérateur parmi les plus grands fournisseurs d'inférence au monde — l'affirmation ressemble moins à une spécification qu'à un défi de test de résistance, ce qui correspond au schéma habituel : les lancements anonymes sont la façon dont un laboratoire obtient un trafic réel à l'échelle des modèles de pointe sans mettre son nom sur la porte.

L’autre face de « gratuit pendant une semaine », c’est qu’aucun prix n’est connu après la semaine. Les modèles anonymes précédents soit restaient gratuits, soit étaient intégrés à leur révélation ultérieure ; la fenêtre gratuite d’Ox Alpha crée une échéance, et le chiffre réel pourrait se situer n’importe où. C’est la principale raison de ne pas concevoir un budget de production autour du 0 $ actuel.

Pas encore de benchmarks — mais déjà du trafic réel.

La fiche d'Ox Alpha ne contient aucune donnée de benchmark : ni indice d'intelligence, ni score de codage, ni score agentique, et il n'apparaît pas sur les classements indépendants tels que Artificial Analysis. Le mot « frontier » est propre à l'opérateur, et il n'existe encore aucune preuve vérifiée de la qualité réelle du modèle.

A screenshot of the Artificial Analysis models leaderboard as of August 21, 2026, showing the Intelligence section led by Claude Opus 5 and Claude Fable 5, the largest context-window highlights, and the output-speed rankings — a frontier leaderboard Ox Alpha has no independent score on yet.

Ce qui existe, c'est l'usage. Les données d'activité de la plateforme montrent un trafic de production réel dès les premières heures — notamment Hermes Agent, le projet de codage agentique de Nous Research, et l'éditeur Zed. Les deux sont exactement les cas d'usage « travail agentique soutenu et codage » pour lesquels le modèle est positionné. Ce n'est pas un score, mais c'est un signal : des développeurs ayant de vraies charges de travail ont décidé qu'un pari gratuit, de classe frontière et anonyme valait la peine d'être branché. Pour un modèle sans aucun benchmark publié, cette adoption précoce est la seule preuve qui existe.

Les petits caractères de la conservation des données

L'annonce de la semaine gratuite vante « zéro conservation des données ». La fiche du modèle sur la plateforme raconte une histoire plus nuancée : les prompts et les complétions sont conservés par le fournisseur, mais ne servent pas à l'entraînement, selon les conditions du modèle furtif de la plateforme. La différence compte si vous êtes sur le point de coller du code propriétaire dans une fenêtre d'un million de jetons appartenant à un opérateur anonyme. Traitez « zéro conservation des données » comme du marketing jusqu'à ce que l'opérateur publie des conditions qui le disent explicitement — et acheminez tout ce que vous ne voudriez pas voir journalisé via un modèle séparé et attribuable.

Le playbook du modèle anonyme

Ox Alpha est la cinquième sortie anonyme en six mois, et les quatre précédentes se sont résolues de la même manière — des débuts anonymes, une explosion de trafic gratuit, puis une entreprise qui se manifeste :

• Pony Alpha (février 2026) — confirmé par Zhipu AI environ cinq jours après le lancement comme GLM-5, son modèle phare MoE de 744B paramètres.

• Hunter Alpha (11 mars) — un modèle gratuit de mille milliards de paramètres avec un contexte de 1M, qui est devenu l'objet de toutes les spéculations du printemps, que beaucoup pensaient être DeepSeek V4 ; il s'est révélé être le MiMo-V2-Pro de Xiaomi, avec son compagnon Healer Alpha identifié comme MiMo-V2-Omni.

• Elephant Alpha (avril) — un modèle de texte gratuit, axé sur l'efficacité, qu'Ant Group a revendiqué comme étant Lingxi Ling-2.6-flash environ deux semaines après son apparition.

• Owl Alpha (fin avril) — un modèle orienté agent avec appel d'outils natif et un contexte d'environ 1M que Meituan a confirmé comme étant LongCat-2.0 le 30 juin, le premier modèle à mille milliards de paramètres entièrement entraîné et servi sur des puces chinoises domestiques.

• Ox Alpha (20 août) — non réclamé au moment d’écrire ces lignes.

A two-column scorecard titled 'The anonymous models — and their reveals', listing Pony Alpha revealed as GLM-5 by Zhipu AI, Hunter Alpha as MiMo-V2-Pro by Xiaomi, Elephant Alpha as Lingxi Ling-2.6-flash by Ant Group, Owl Alpha as LongCat-2.0 by Meituan, and Ox Alpha marked '??? — unclaimed', with a footer noting reveals per each lab's public announcement and Ox Alpha unclaimed as of August 21, 2026, and the OrcaRouter logo in the bottom-right corner.

Pourquoi lancer un bon modèle derrière un masque ? La lecture standard, que le cycle Hunter Alpha a rendue concrète, est que l'anonymat élimine le biais de marque dans les évaluations, et que l'utilisation gratuite permet de crowdsourcer des données d'évaluation réelles à l'échelle des modèles de pointe, pendant que tout le monde débat du propriétaire. Comme le dit une analyse de ce schéma : « l'absence de marque est le marketing. » L'avantage supplémentaire, c'est la rapidité : un modèle anonyme peut atteindre un public mondial de développeurs en quelques heures, sans événement de lancement, et le mystère lui-même devient la distribution.

Qui est Ox Alpha ?

Personne ne l'a revendiqué, et il n'y a pas encore de preuve tangible. Ce qui existe, c'est un a priori : quatre des quatre versions anonymes résolues se sont avérées provenir de laboratoires chinois, et le profil d'Ox Alpha correspond à la même forme — un modèle de raisonnement axé sur le codage et les agents, avec un contexte de 1M et une revendication de capacité confiante, est exactement le genre de chose qu'un grand fournisseur expédie pour tester sa pile de service à grande échelle.

Le signal distinctif est l'entrée vidéo, qu'aucun des modèles anonymes précédents n'avait annoncée ; cela resserre le champ autour des laboratoires menant des travaux sérieux en multimodal et en vidéo. Mais un a priori n'est pas une preuve, et cette publication diffère de ses prédécesseurs sur un point notable : l'opérateur revendique une posture de non-conservation, alors que les modèles anonymes précédents étaient explicites quant à la collecte de vos données. Si cela se confirme, le motif passe de la boucle de données à un pur test à grande échelle ou à un positionnement de pré-lancement. Tant qu'aucune entreprise ne se manifestera — ou que le modèle ne révélera un indice sur son architecture —, chaque supposition restera une supposition.

Devriez-vous construire dessus cette semaine ?

Cette semaine, cela ne coûte rien d'autre que du temps d'intégration. Si vous faites du travail agentique à long horizon, codez sur de longs contextes ou exécutez des pipelines gourmands en vidéo, c'est exactement l'intersection où se positionne Ox Alpha — et la fenêtre gratuite est le bon moment pour vérifier si ce positionnement est réel. Deux mises en garde. Premièrement, il n'existe aucune preuve indépendante qu'il soit de classe frontière ; l'étiquette « frontière » n'est qu'une affirmation. Deuxièmement, rien ne garantit que le niveau gratuit — ou le modèle — survive à la semaine. C'est la forme d'un test, pas d'une dépendance.

La méthode sûre en production pour mener un tel test est une chaîne de repli : le modèle expérimental répond lorsqu'il est opérationnel, et la requête est redirigée vers un modèle éprouvé dès qu'il se bloque, produit une erreur ou disparaît. C'est à cela que sert une couche de routage. Une seule API pour plus de 200 modèles, un basculement automatique pour que le trafic de lancement de la semaine gratuite d'un modèle anonyme ne devienne pas votre panne, et une marge de 0 % — le prix catalogue du fournisseur est répercuté — afin que lorsque le vrai prix d'Ox Alpha apparaît après la semaine gratuite, le nombre que vous voyez soit celui que vous payez, le jour même où l'opérateur le modifie. Utilisez la semaine gratuite pour auditionner ; décidez après la révélation.

Que regarder

Quatre choses raconteront l’histoire. La révélation : par le passé, des modèles anonymes ont été revendiqués des jours à des semaines après leur lancement, et lorsqu’une entreprise se manifestera, la page du modèle la nommera. Le prix : ce qui remplacera l’offre gratuite, et si une offre gratuite survit tout court. Les premiers benchmarks indépendants : une entrée sur Artificial Analysis ou LMArena permettrait de déterminer si « frontier » est un fait ou un simple slogan. Et la capacité : si les 100 000 milliards de tokens par jour annoncés tiennent sous une charge réelle.

Le verdict honnête : Ox Alpha est une expérience inhabituellement peu coûteuse dans les deux sens. La plateforme teste si un modèle anonyme de pointe, à 0 $, peut gagner du trafic de production réel en une semaine ; vous, vous testez si le modèle le mérite. Menez l'expérience, mais menez-la avec un filet de sécurité en dessous. D'ici la fin de la semaine gratuite, il y a de bonnes chances que nous sachions qui l'a créé, ce qu'il coûte, et s'il a gagné sa place dans votre stack — et ces trois réponses sont ce qui rend l'audition intéressante.

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube