
Atria Dawn Preview: InternLM brengt stilletjes een agentisch model met 744B parameters uit — wat de repo eigenlijk zegt
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0240Intelligentie72Coderen
- anthropicNIEUWAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligentie69Coderen
De InternLM-organisatie van Shanghai AI Laboratory publiceerde deze week stilletjes Atria Dawn Preview op Hugging Face — een voorproefje van een agentisch MoE-model met 744B parameters dat komt met onder MIT-licentie vrijgegeven gewichten, een contextvenster van 1M tokens en een benchmarktabel die is gemeten tegen DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol en Claude Opus 5. De repository ging live op 11 september 2026 — drie dagen voor dit stuk — met een bijbehorend FP8-checkpoint dat volgde op 12 september, en de leverancier heeft het model nog nergens aangekondigd: geen blogpost, geen paper, geen prijsstelling, geen API. Wat vandaag bestaat, is een volledig ingevulde modelkaart en ongeveer 1,5 TB aan open gewichten. Dat maakt van Atria Dawn Preview een stilletjes uitgebrachte release, en de interessante vragen zijn wat de kaart je laat verifiëren, wat hij van je vraagt op goed vertrouwen aan te nemen, en of dit de eerste stap is naar een grotere Atria-familie van het lab dat het hele jaar de Intern-S2- en InternLumina-series heeft uitgebracht.
De kaart is de aankondiging
Omdat er geen aankondiging is, moet de Hugging Face-kaart alles vertellen. Daarin wordt Atria Dawn Preview beschreven als "een previewversie van een agentisch model van een nieuwe generatie", ontwikkeld door het Shanghai AI Laboratory, getraind op een MoE-basismodel met 744B parameters, en gericht op "onderzoeks- en engineering-scenario's die continu begrip van de omgeving, toolgebruik en het voltooien van taken in meerdere stappen vereisen." De slogan — "From Research Questions To Verifiable Results" — draait erom open-ended problemen richting uitvoerbare, verifieerbare, reproduceerbare resultaten te sturen, waarbij het model taakdoelen en omgevingsfeedback combineert bij probleemanalyse, oplossingsontwerp, toolgebruik, code-implementatie, experimentuitvoering, resultaatanalyse en herstel na fouten.
De kaart organiseert die agentische scope in vier capaciteitsgebieden, elk gericht op end-to-end levering in plaats van chat:
• Discovery — bewijs verzamelen en ordenen, diepgaand onderzoek, onderzoeksvragen omzetten in uitvoerbare experimentele plannen
• Creatie — het bouwen van software, interactieve applicaties, games, datavisualisaties en machine learning-systemen
• Oplevering — het omzetten van documenten, data en ontwerpvereisten in rapporten, presentaties en andere gestructureerde opleveringen
• Cyberbeveiliging — het analyseren van beveiligingsproblemen, het valideren van kwetsbaarheden, het toepassen van correcties en het opnieuw valideren in geautoriseerde omgevingen
Ook op de kaart, maar onverklaard: een website (atria-asi.com), een GitHub-organisatie (atria-asi) die de README spiegelt, en een X-account (@AtriaASI). Het achtervoegsel "ASI" is het enige echt vreemde detail — niets op de kaart zegt wat de branding geacht wordt te impliceren, en we gaan er niet meer in lezen dan de repo zelf doet. Wat wel te weten valt, is dat dit een codenaam van een afzonderlijke productlijn is, los van de namen Intern-S2 en InternLumina die het lab het hele jaar heeft gebruikt.

Wat de configuratie eigenlijk zegt
De gewichten en configuratie zijn vandaag downloadbaar, en dat is het punt waarop een stille release ophoudt een gerucht te zijn. De architectuurstring is GlmMoeDsaForCausalLM — dezelfde DSA-achtige sparse MoE-familie die de GLM-lijn gebruikt, waarbij de configuratie 8 van de 256 routed experts per token over 78 lagen routeert (het aantal actieve parameters wordt niet op de kaart vermeld; bij een 744B MoE van deze vorm komt het uit in de tientallen miljarden). Het contextvenster is ingesteld op 1.048.576 tokens — een volledige 1M, passend bij de lange-contextklasse die het lab in zijn andere recente releases heeft doorgevoerd. De tokenizer bevat markeringen voor beeld, video, audio en transcriptie, hoewel de chatsjabloon het model expliciet vertelt dat het geen multimodale invoermogelijkheid heeft en dat het dat moet zeggen als het media krijgt — beschouw de modaliteitstags dus als geërfde infrastructuur, niet als een claim van visuele of audio-invoer.
De gewichten vertellen het praktische verhaal:
• Checkpoints — twee: het BF16/F32-instructmodel en Atria-Dawn-Preview-FP8, een FP8-gekwantiseerd instructmodel
• Grootte — de BF16-release is ongeveer 1,5 TB verdeeld over 353 safetensors-shards; de FP8-release is ongeveer 756 GB
• Licentie — MIT, voor zowel code als gewichten, zonder beperkende clausule op de kaart — ongewoon permissief voor een labrelease van deze omvang
• Distributie — Hugging Face en ModelScope, Engelse en Chinese READMEs, een chatsjabloon en een generatieconfiguratie in de repository
• Hosting — er staan geen inference providers op de kaart vermeld en er wordt nergens een API genoemd
Die laatste regel is belangrijk voor de framing: dit is een gewichtenrelease, geen servicelancering. Iedereen die Atria Dawn Preview vandaag wil draaien, moet ongeveer 756GB (FP8) of 1,5TB (BF16) downloaden en het zelf serveren — geen leveranciersendpoint, geen prijsstelling, geen quotapagina.
De benchmarktabel, lees aandachtig
De kaart bevat een benchmarktabel met 16 rijen die Atria Dawn Preview vergelijkt met DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol en Claude Opus 5 op het gebied van agentische, tool-use-, coding- en researchbenchmarks. Elk cijfer erin is door de leverancier gerapporteerd — het lab heeft de evaluaties uitgevoerd of laten uitvoeren, en geen ervan is onafhankelijk gereproduceerd, omdat er nog geen onafhankelijke evaluatie van Atria Dawn Preview bestaat. Artificial Analysis geeft op dit moment geen pagina voor het model. De juiste lezing is dus "dit is hoe de leverancier zegt dat het zich verhoudt", niet "dit is hoe het zich verhoudt".

Nu die kanttekening stevig is vastgelegd, zijn de hoogtepunten werkelijk interessant. Atria Dawn Preview voert het vermelde veld aan op BrowseComp met 92,5 (tegenover de 92,2 van GPT-5.6 Sol en de 90,8 van Claude Opus 5), op CyberGym met 86,5 (vóór de 83,3 van DeepSeek V4 Pro, de 84,5 van GLM-5.3 en de 83,6 van GPT-5.6 Sol), en op DeepSearchQA met 96,0. Het scoort ook een sterke BFCL v4 van 77,0 tegenover de 71,4 van DeepSeek V4 Pro en de 69,1 van Kimi K3. De zwakke plekken zijn net zo informatief:
• Terminal-Bench 2.1 — 78,3, ruim achter de 89,3 van Qwen3.8-Max en de 90,2 van Claude Opus 5, wat erop wijst dat de kwaliteiten als coding-agent nog niet van vlaggenschipniveau zijn
• SWE-bench Pro — 59,6, voor op DeepSeek V4 Pro (58,3) maar ver achter de 74,7 van Claude Opus 5
• MLE-bench Lite — 86,2, wat achterblijft bij GPT-5.6 Sol (88,9) en Claude Opus 5 (88,0), ondanks de Discovery-pitch
• JobBench — 50,3, het laagste van de modellen die de kaart vermeldt, en een van de verschillende rijen waar een open 744B-preview onderpresteert ten opzichte van de gesloten topmodellen waarnaast hij is afgedrukt
De eerlijke samenvatting: de kaart claimt echte sterke punten op het gebied van onderzoeksretrieval, browsergerichte taken en beveiligingsvalidatie, terwijl de klassieke rijen voor coderen en kenniswerk middenmoot ogen. Een preview die niet aan cherry-picking doet, is geloofwaardiger dan een die alles wint — maar niets ervan is geverifieerd, en een model van deze omvang met zo veel evaluatieoppervlak verdient een onafhankelijke blik voordat iemand er een pipeline op waagt.
Waar het staat in de InternLM-line-up
Atria Dawn Preview valt midden in een ongewoon drukke periode voor het lab. Het vision-and-science-vlaggenschip Intern-S2-397B verscheen op 13 september, dezelfde familie waarvan de kleinere broertjes (Intern-S2, Intern-S2 Mobius) sinds medio dit jaar zijn uitgekomen, en de op visie gerichte InternLumina-U2 ging begin september live. Atria is een afzonderlijke codenaam die op algemeen agentisch werk is gericht in plaats van op wetenschappelijke of multimodale specialisatie — en anders dan Intern-S2-397B, dat een Apache-2.0-licentie en zijn eigen aankondigingsecosysteem heeft, kwam Atria Dawn Preview zonder ceremonie onder MIT. Of Atria een eenmalige preview is of het eerste lid van een nieuwe serie, is niet bevestigd; het achtervoegsel "Preview" en de kale repo, zonder ergens roadmaptekst, pleiten voor de voorzichtige lezing.
Wat is nog niet bekend?
De nuttige gewoonte bij een stille release is om op te sommen wat nog openstaat. Op Atria Dawn Preview is die lijst lang:
• Een aankondiging — niets van het lab, de website of het X-account sinds 14 september; de repo verscheen als eerste, wat bij verschillende recente releases van Chinese labs ook zo is gegaan, maar "hoe het gewoonlijk gaat" is geen bevestiging
• Een paper of technisch rapport — geen enkele gelinkt; de trainingsgegevens, de RL-pijplijn en het aantal actieve parameters zijn allemaal ongepubliceerd
• De branding "Atria ASI" — het domein en de handle bestaan en de kaart linkt ze aan elkaar, maar welke entiteit erachter zit en waarvoor de initialen bedoeld zijn, wordt niet vermeld
• Onafhankelijke scores — geen; geen vermelding in Artificial Analysis, geen aanwezigheid in de arena, niets om de tabel op de kaart mee te vergelijken
• Beschikbaarheid via hosting — geen vendor-API, en geen enkele grote inference-gateway serveert het nog; de enige manier om het te draaien is om zelf ongeveer 756GB tot 1,5TB aan weights op te zetten
• Serving-ondersteuning — de architectuur is een bekende DSA-MoE-lijn, wat het soort ding is dat doorgaans snel runtime-ondersteuning krijgt, maar voor deze specifieke checkpoint is nog geen frameworkondersteuning aangekondigd
Wat je er eigenlijk mee kunt doen
Concreet zijn vandaag drie dingen waar. Ten eerste kun je Atria Dawn Preview downloaden — de MIT-licentie dekt beide checkpoints, en de FP8-release maakt de opslag- en serveerberekening aanzienlijk eenvoudiger dan het BF16-origineel, al is elk van beide een multi-GPU-aangelegenheid. Ten tweede kun je het nergens aanroepen: er is geen gehost endpoint, en dat is precies de situatie waarin een routeringsplatform zijn bestaansrecht verdient. We routeren Atria Dawn Preview nog niet — het staat niet op OrcaRouter, en deze pagina doet niet alsof dat wel zo is — maar dezelfde sleutel die vandaag geen Atria heeft, bereikt al 196 andere modellen via één API, met de lijstprijs van de provider doorgegeven tegen 0% opslag en automatische failover tussen providers. Wanneer Atria Dawn Preview bij een gerouteerde provider terechtkomt, verschijnt het tegen lijstprijs op dezelfde dag dat de cijfers van de leverancier worden bijgewerkt, wat pass-through-pricing in de praktijk betekent. Tot die tijd is het model een download-and-run-project, en de veiligste manier om het te evalueren is op hardware die je zelf beheert, met een onafhankelijke benchmark van jezelf — niet op het woord van de kaart.

Wat nu te kijken
Vier signalen bepalen of deze stille release een verhaal wordt waar je iets mee doet. Het eerste is de aankondiging: een degelijke launchpost of paper zou antwoord geven op de architectuur, het trainingsrecept en waar "Preview" een preview van is. Het tweede is een onafhankelijke evaluatie — een model van deze omvang met een modelkaart die zo zelfverzekerd is, moet zijn BrowseComp- en CyberGym-claims tegen een neutrale testomgeving laten controleren, en het ontbreken van enige vermelding in Artificial Analysis is de meest opvallende leemte. Het derde is gehoste beschikbaarheid: een open 744B MoE met MIT-gewichten en een contextvenster van 1M is precies het profiel dat doorgaans binnen enkele weken bij inferenceproviders opduikt, en de eerste die het aanbiedt, bepaalt de praktische prijs van het gebruik ervan. Het vierde is de vraag naar de familie — of Atria een eenmalige release is of een reeks, en of de "ASI"-branding aangeeft waar het lab de lijn vervolgens naartoe wil brengen. Niets daarvan valt uit de repo op te maken, en dat is precies het punt: de repo gaf ons het model, en de komende twee weken zouden ons de rest moeten geven.
Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
