
BAAI a mis AREX-2 sur Hugging Face hier soir, et le dépôt est presque vide
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 397 tok/s
- OpenAINOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- OpenAINOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAINOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 195 tok/s
- OrcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- xAISpaceXAI: Grok 4.62026-08-1244Intelligence77Code
Le 29 septembre 2026 à 17:56 UTC, la Beijing Academy of Artificial Intelligence a créé un dépôt Hugging Face appelé AREX-2. À l'heure où nous écrivons, ce dépôt contient un seul fichier — un .gitattributes— et il stocke zéro octet de données de modèle. Il n'y a pas de fiche de modèle, pas de nombre de paramètres, pas de description d'architecture, pas de benchmark, pas de licence, pas d'annonce sur le site de BAAI lui-même, et aucune publication sur les réseaux sociaux de la part de qui que ce soit au laboratoire. L'API de Hugging Face indique zéro téléchargement et zéro like. Aucun fournisseur d'inférence ne le propose. BAAI n'en a pas dit un mot. Ce n'est pas une histoire de lancement. C'est l'histoire d'un nom réservé par un laboratoire qui ne réserve pas les noms à la légère, publiée ici parce que la seule chose qui est connaissable — qui a mis le dépôt en ligne, et à quoi ressemble le bilan 2026 de cette organisation — suffit à dire quelque chose d'utile sur ce qui est probablement à venir, et à être précis sur la différence entre cela et le fait de savoir.
La distinction importe plus que d’habitude ici. Un dépôt créé quelques heures avant l’écriture de cette phrase est véritablement récent, et un article de type « ce que nous savons pour l’instant » à son sujet peut être exact. Ce qu’il ne peut pas faire, c’est décrire un modèle. Ainsi, tout ce qui suit est divisé clairement : les faits lus directement sur Hugging Face lors de cette session, et les attentes dérivées de la famille AREX déjà publiée. Si vous êtes venu ici pour les caractéristiques techniques d’AREX-2, la réponse honnête est qu’AREX-2 n’en a pas encore, et un paragraphe de chiffres d’apparence plausible serait pire que celui-ci.
Qu'y a-t-il réellement dans le dépôt ?
Tout ce qu'il est possible de savoir publiquement sur AREX-2 tient dans une courte liste, et il vaut la peine de l'énoncer intégralement afin que rien de ce qui suit plus bas ne soit pris pour elle.
• Le dépôt existe — huggingface.co/BAAI/AREX-2, créé le 2026-09-29T17:56:21Z, modifié pour la dernière fois au même instant. Un seul commit, à la création, constitue tout l'historique Git.
• Ce n'est pas dénué d'intention — le nom frère vers lequel il pointe n'est pas une chaîne aléatoire. La gamme AREX de BAAI existe déjà au sein de cette même organisation : AREX-Base et AREX-Turbo, tous deux créés le 23 juillet 2026, tous deux des sorties de poids complets sous Apache 2.0.
• Il est vide de tout le reste — pas de poids, pas de configuration, pas de tokeniseur, pas de texte README, pas d’étiquette de licence, pas de téléchargements, pas de likes, pas de déploiement de fournisseur.
• Il est tout nouveau, non repris — le dépôt ne possède qu'un seul horodatage de création. Il n'existe aucune incarnation antérieure de ce nom sous BAAI, et aucun réenvoi sous une orthographe variante apparue lors d'une recherche.
La capture d'écran ci-dessous constitue l'intégralité de sa surface publique. C'est le fait auquel le reste de ce texte doit rester fidèle : BAAI a revendiqué un nom, et n'a encore rien mis derrière celui-ci.

Ce que « AREX-2 » prolonge très probablement
La raison pour laquelle un dépôt presque vide vaut dix-huit cents mots, c'est que la chose dont il est probablement une deuxième version est exceptionnellement bien documentée.
AREX-Base, à partir de juillet, est un modèle mixture-of-experts de 122 milliards de paramètres avec 10 milliards de paramètres actifs, construit sur une base Qwen3.5-122B-A10B et publié sous licence Apache 2.0. Ce n'est pas un modèle de chat qui se trouve bien chercher par hasard ; c'est un agent de recherche approfondie conçu avec une architecture à deux boucles. Une boucle interne rassemble les preuves, assemble une réponse candidate et y associe un indice de confiance. Une boucle externe vérifie cette réponse par rapport aux contraintes d'origine et peut l'accepter, l'affiner, ou rejeter la trajectoire et repartir de zéro. Entre les boucles, il maintient un bloc de contexte contenant les constats vérifiés, les candidats ouverts, les contraintes non résolues et le prochain plan, et il pilote la recherche et la navigation comme des outils.
D’après les propres chiffres publiés par BAAI — rapportés par le fournisseur, non reproduits de façon indépendante — cet agent obtient 82,5 sur BrowseComp, 85,4 sur GAIA, 71,0 sur xbench-2510, 89,9 sur DeepSearch QA et 82,0 sur WideSearch-en. Son homologue 4B AREX-Turbo, bâti sur Qwen3.5-4B, obtient 70,7, 81,6, 57,0, 78,5 et 68,5 sur le même ensemble. Ce sont de solides résultats pour un agent de première génération, et l’écart entre le 122B et le 4B est l’aspect intéressant de la famille : BAAI a conçu un échelon de qualité et un échelon de coût de service au sein d’une même version.
Rien de tout cela ne se transpose automatiquement à AREX-2. Un « 2 » dans le nom d'un modèle est une convention de nommage, pas un contrat. Il pourrait désigner une architecture de deuxième génération, un Base plus grand, une distillation plus petite, un agent réentraîné avec le cadre à deux boucles conservé et le backbone remplacé, ou quelque chose que le nom de famille ne laisse pas du tout présager. Ce qu'il suggère — et il s'agit d'une inférence, clairement annoncée comme telle —, c'est que BAAI poursuit une lignée d'agents plutôt que d'en ouvrir une nouvelle, car un laboratoire qui voudrait un modèle inédit ne dépenserait pas son propre nom de famille pour cela.
Où se situe le reste du bilan 2026 de BAAI
Ce qu’on peut dire de plus fort d’AREX-2 aujourd’hui concerne l’organisation, pas le modèle. L’historique 2026 de BAAI sur Hugging Face est une succession régulière de véritables sorties de poids : Orca-4B le 12 juillet, le duo AREX-Base et AREX-Turbo le 23 juillet, puis Recon2Reason-Reasoning-4B, ConsiSpace, AIDD et Brainmu-Spike jusqu’en septembre, et une traîne plus longue dans les séries RoboBrain, URSA, Emu3.5 et OpenSeek. Ils ne sont pas tous célèbres, et ils n’ont pas tous fait l’objet de benchmarks, mais ce sont tous des artefacts livrés sous licences ouvertes.
C’est ce schéma qui fait que ce dépôt mérite un article, et qu’un nom squatté par un compte anonyme n’en mériterait pas. C’est aussi la raison pour laquelle il faut être prudent : la même organisation a, au cours des quatre dernières semaines, mis en ligne des dépôts qui sont restés vides pendant plus d’une journée. Un nom réservé est un signal d’intention, et une intention n’est pas une version publiée. Si vous planifiez des capacités autour d’AREX-2, vous n’avez pas de date et vous ne devriez pas en inventer une.


Que devrait-il se passer pour que cela devienne appelable ?
Il y a quatre points de contrôle entre « le dépôt existe » et « vous pouvez le mettre en production », et ils peuvent survenir dans n'importe quel ordre.
Le premier, ce sont les poids : les safetensors réels dans l'arborescence, le point où le modèle devient inspectable et quantifiable par n'importe qui. Le deuxième, c'est une fiche : le nombre de paramètres, le modèle de base, la fenêtre de contexte et le tableau d'évaluation qui vous disent ce que vous téléchargez. Le troisième, c'est une licence, qui pour cette famille a été Apache 2.0 — un choix par défaut permissif qui, s'il se maintient, élimine entièrement la question d'une licence à revenus plafonnés.
Le quatrième est une route, et c'est celui dont la plupart des lecteurs de ce blog se soucient réellement. AREX-Base ne figure pas au catalogue d'OrcaRouter aujourd'hui, et AREX-2 non plus, de toute évidence. Quand un modèle de ce type finit par arriver avec des poids ouverts, l'intérêt d'une couche de routage, c'est que pour y accéder, il ne faut ni un second contrat ni un nouveau client — une seule API devant plus de 200 modèles, le prix catalogue du fournisseur répercuté sans marge ajoutée, donc le prix du fournisseur au moment de la publication est celui que vous voyez, et un basculement automatique pour qu'une mauvaise après-midi chez un fournisseur ne devienne pas une mauvaise après-midi pour votre agent. Pour un agent de recherche qui se ramifie sur des dizaines d'appels d'outils par requête, cette dernière propriété vaut plus qu'elle n'en a l'air : les modes de défaillance d'une boucle de recherche approfondie découlent le plus souvent d'un seul fournisseur capricieux.
Nous dirons la même chose quand AREX-2 aura des poids qu'aucun hôte ne sert encore : le failover est la façon de tester un modèle non éprouvé sur une voie secondaire sans miser la principale dessus.
À quoi ressemblera cette page lorsque le dépôt se remplira
Trois issues sont possibles, et elles sont distinguables de l'extérieur.
Si l'arborescence gagne des safetensors dans les prochains jours, cela devient une véritable histoire de sortie discrète, qui sera réécrite avec de vrais nombres de paramètres et la licence lue sur la fiche. C'est la forme habituelle pour cette organisation, et c'est le résultat que l'horodatage pointe.
Si le dépôt reste vide pendant des semaines et qu'un article paraît en premier — la première génération de la famille AREX est sortie en même temps qu'arXiv 2607.21461 —, alors le titre honnête est qu'une deuxième génération fait l'objet de recherches et que le dépôt était un espace réservé pour celle-ci.
S’il ne se passe rien du tout, alors rien ne s’est passé, et la chose correcte à publier, c’est rien. Un nom réservé qui ne se remplit jamais n’est pas une histoire, et il ne faut pas le faire passer pour une histoire.
Deux faits suffisent pour vérifier cela vous-même, sans vous fier au résumé de qui que ce soit. L'arborescence des fichiers du dépôt, qui contient ou non les poids, et la date de création du dépôt, qui ne changera pas. Tout le reste à propos d'AREX-2 — sa taille, ses benchmarks, s'il s'appellera même AREX-2 lors de sa sortie — est actuellement inconnu, et cet article ne prétendra pas le contraire.
