
Ox Alpha: Het anonieme frontiermodel dat een week gratis is — en niemand zal zeggen wie het heeft gemaakt
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenNIEUWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNIEUWDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokNIEUWSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligentie77Coderen
- grokxAI: Grok 4.52026-07-0856Intelligentie72Coderen
Op 20 augustus een anoniem grensverleggend model genaamd Ox Alpha verscheen op een API-platform van een derde partij met een contextvenster van 1 miljoen tokens, tekst-/beeld-/video-invoer en een prijs van nul. Niemand heeft gezegd wie het heeft gebouwd — en die stilte is op zichzelf het verhaal. De laatste vier modellen die op dezelfde anonieme manier werden uitgebracht, werden uiteindelijk allemaal opgeëist door Chinese labs: Zhipu AI's GLM-5, Xiaomi's MiMo-V2-Pro, Ant Group's Lingxi Ling-2.6-flash, en Meituan's LongCat-2.0. Ox Alpha, vermeld onder de ID stealth/ox-alpha, is de vijfde vermelding in die reeks. Het is de komende week gratis, en naar het patroon van de vorige vier volgt de onthulling meestal snel.
Elk cijfer in dit stuk is een eigen claim van de operator, gegevens uit de eigen vermelding van het platform, of een openbare aankondiging — er zijn nog geen onafhankelijke benchmarks, en niets hiervan mag worden aangezien voor een dergelijke benchmark.
Wat we weten — en wat we niet weten.
De snelle versie:
De operator beschrijft Ox Alpha als "een grensverleggend model dat is gebouwd voor efficiënt coderen, aanhoudend agentisch werk en productiegebruik in de echte wereld" — een redeneringsmodel gericht op software-engineering over lange termijn en workflows die tekst met visuele context combineren.
Het heeft een contextvenster van 1,048,576 tokens (1M), een uitvoerlimiet van 131,072 tokens, en accepteert tekst-, afbeeldings- en video-invoer — de eerste van de anonieme releases die video-invoer adverteert.
• Het is één week gratis: $0 per miljoen tokens in en uit, waarbij de exploitant claimt "royale snelheidslimieten, vrijwel onbeperkt gebruik" en 100 biljoen tokens per dag aan servercapaciteit.
• Vroege activiteitsgegevens op het platform tonen al echte productieverkeer, waaronder een codeeragent van Nous Research en de Zed-editor.
• Geen enkel bedrijf heeft het opgeëist per 21 augustus, er zijn geen benchmarkresultaten van welke aard dan ook, de echte prijs na de gratis week is onbekend, en de architectuur van het model en het aantal parameters zijn niet bekendgemaakt.
Wat Ox Alpha is
De vermelding op het platform beschrijft Ox Alpha als "een redenerend model ontworpen voor coderen, langdurig agentisch werk en productieworkloads — software-engineering over een lange tijdshorizon, complex redeneren en workflows die tekst combineren met visuele context." Dat is een specifieke positionering: het is gebouwd voor langlopende agent-loops en voor code, niet voor algemene chat. De 1M-context is de weggever — dat is genoeg ruimte voor een agentsessie van meerdere uren of een grote repository — en de outputlimiet van 131K maakt lange afzonderlijke generaties mogelijk. Het ondersteunt tool- en function calling en gestructureerde JSON-output, wat de rest van de agentische checklist is.

De video-invoer is het meest onderscheidende item op het blad. Geen van de eerdere anonieme modellen adverteerde ermee, en een model dat naast tekst en afbeeldingen ook videoframes kan verwerken, is gericht op een andere klasse van workloads dan de chat-afgestemde releases die eraan voorafgingen. Dit alles — de beschrijving, de specificaties, de snelheidscijfers — komt van de operator en de listing op het platform. Niets daarvan is onafhankelijk geverifieerd.
Het gratis-voor-een-week-aanbod
De promotie is agressief. Gratis voor de komende week, "royale snelheidslimieten, vrijwel onbeperkt gebruik," en een vermeende capaciteit van 100 biljoen tokens per dag, met een opmerking van de operator die gebruikers uitnodigt om "te zien wat je kunt doen." Letterlijk genomen zou 100 biljoen tokens per dag deze operator bij de grootste inferentieproviders ter wereld plaatsen — de bewering leest minder als een specificatie en meer als een stresstest-uitdaging, wat past in het patroon: anonieme releases zijn hoe een lab real-world verkeer op frontiervoet krijgt zonder zijn naam aan de deur te hangen.
De andere kant van "gratis voor een week" is dat er na die week geen bekende prijs is. De eerdere anonieme modellen bleven ofwel gratis ofwel werden later in hun onthulling opgenomen; het gratis venster van Ox Alpha creëert een deadline, en het echte getal kan overal terechtkomen. Dat is de belangrijkste reden om geen productiebudget te ontwerpen rond de huidige $0.
Nog geen benchmarks — maar al wel echt verkeer.
De vermelding van Ox Alpha bevat geen benchmarkgegevens: geen intelligentie-index, geen codeerscore, geen agentische score, en het staat niet op onafhankelijke ranglijsten zoals Artificial Analysis. Het woord 'frontier' is van de operator zelf, en er is nog geen geverifieerd bewijs van hoe goed het model daadwerkelijk is.

Wat er wel is, is gebruik. De activiteitsgegevens van het platform tonen echte productietraffic binnen de eerste uren — waaronder Hermes Agent, het agentische codeerproject van Nous Research, en de Zed-editor. Beide zijn precies de use cases van 'aanhoudend agentisch werk en coderen' waar het model voor gepositioneerd is. Het is geen score, maar het is een signaal: ontwikkelaars met echte workloads besloten dat een gratis, frontier-klasse, anonieme gok het waard was om aan te sluiten. Voor een model met nul gepubliceerde benchmarks is die vroege adoptie het enige bewijs dat er is.
De kleine lettertjes over gegevensbewaring
De aankondiging van de gratis week roept "nul dataretentie". De vermelding van het model op het platform vertelt een genuanceerder verhaal: prompts en completions worden bewaard door de aanbieder, maar niet gebruikt voor training, onder de stealth-modelvoorwaarden van het platform. Het verschil doet ertoe als je op het punt staat propriëtaire code te plakken in een 1M-token venster van een anonieme operator. Beschouw "nul dataretentie" als marketing totdat de operator voorwaarden publiceert die dat met zoveel woorden zeggen — en leid alles wat je niet gelogd wilt hebben via een apart, herleidbaar model.
Het draaiboek voor het anonieme model
Ox Alpha is de vijfde anonieme release in zes maanden, en de vorige vier eindigden op dezelfde manier — een anoniem debuut, een uitbarsting van gratis verkeer, en dan een bedrijf dat naar voren stapt:
• Pony Alpha (februari 2026) — bevestigd door Zhipu AI ongeveer vijf dagen na de lancering als GLM-5, het MoE-vlaggenschip met 744B parameters.
• Hunter Alpha (11 maart) — een gratis model met een biljoen parameters en een 1M-context dat het speculatieverhaal van de lente werd, waarvan algemeen werd vermoed dat het DeepSeek V4 was; onthuld als Xiaomi's MiMo-V2-Pro, met de bijbehorende Healer Alpha geïdentificeerd als MiMo-V2-Omni.
• Elephant Alpha (April) — een gratis, op efficiëntie gericht tekstmodel dat Ant Group ongeveer twee weken na zijn verschijning claimde als Lingxi Ling-2.6-flash.
• Owl Alpha (eind april) — een agentgericht model met native tool calling en een ~1M context die Meituan op 30 juni bevestigde als LongCat-2.0, het eerste model met een biljoen parameters dat volledig op binnenlandse Chinese chips is getraind en ingezet.
• Ox Alpha (20 augustus) — op moment van schrijven nog niet opgeëist.

Waarom een goed model achter een masker lanceren? De gangbare lezing, die de Hunter Alpha-cyclus concreet maakte, is dat anonimiteit merkvooroordeel uit evaluaties weghaalt, en het gratis gebruik crowdsourcet evaluatiedata uit de echte wereld op frontierschaal, terwijl iedereen discussieert over de eigenaar. Zoals een analyse van het patroon het stelde: "het ontbreken van een merk is de marketing." Het extra voordeel is snelheid: een anoniem model kan binnen enkele uren een wereldwijd ontwikkelaarspubliek bereiken zonder lanceerevent, en het mysterie zelf wordt de distributie.
Wie is Ox Alpha?
Niemand heeft het opgeëist, en er is nog geen hard bewijs. Wat er is, is een prior: vier van de vier opgeloste anonieme releases bleken Chinese laboratoria te zijn, en het profiel van Ox Alpha past in dezelfde vorm — een redeneermodel gericht op coderen en agents, met een 1M-context en een zelfverzekerde capaciteitsclaim, is precies het soort ding dat een grote leverancier uitbrengt om zijn serving-stack op schaal te testen.
Het onderscheidende signaal is de video-ingang, die geen van de eerdere anonieme modellen adverteerde; dat vernauwt het veld tot laboratoria met serieuze multimodale en videowerkzaamheden. Maar een prior is geen bewijs, en deze release verschilt op één opmerkelijk punt van zijn voorgangers: de operator claimt een no-retention-houding, terwijl eerdere anonieme modellen expliciet waren over het verzamelen van jouw gegevens. Als dat standhoudt, verschuift het motief van data-flywheel naar pure schaal-testing of pre-launch-positionering. Totdat een bedrijf naar voren stapt — of het model een architectuur-tip lekt — blijft elke gok een gok.
Zou je er deze week op moeten voortbouwen?
Deze week kost het niets behalve integratietijd. Als je langetermijn-agentisch werk doet, code schrijft in lange contexten, of video-intensieve pipelines draait, dan is dat precies het snijvlak waar Ox Alpha zich bevindt — en de gratis periode is het juiste moment om te ontdekken of die positionering echt is. Twee waarschuwingen. Ten eerste is er geen onafhankelijk bewijs dat het topklasse is; het label "frontier" is een bewering. Ten tweede is er geen garantie dat de gratis laag — of het model — de week overleeft. Dat is de vorm van een test, niet van een afhankelijkheid.
De productieveilige manier om zo'n test uit te voeren is een fallback-keten: het experimentele model antwoordt wanneer het gezond is, en het verzoek valt terug op een bewezen model op het moment dat het hapert, fouten geeft of verdwijnt. Dat is waar een routeringslaag voor dient. Eén API voor 200+ modellen, automatische failover zodat het lanceerverkeer van de gratis week van een anoniem model niet jouw uitval wordt, en 0% opslag — de catalogusprijs van de provider wordt doorberekend — zodat wanneer de echte prijs van Ox Alpha na de gratis week verschijnt, het getal dat je ziet het getal is dat je betaalt, op dezelfde dag dat de aanbieder het wijzigt. Gebruik de gratis week om te evalueren; beslis na de onthulling.
Wat te kijken
Vier dingen zullen het verhaal vertellen. De onthulling: {{1}}eerdere anonieme modellen werden dagen tot weken na de lancering opgeëist, en wanneer een bedrijf naar voren stapt, zal de modelpagina het noemen.{{/1}} De prijs: {{2}}wat de gratis laag vervangt, en of er überhaupt een gratis laag blijft bestaan.{{/2}} De eerste onafhankelijke benchmarks: {{3}}een vermelding op Artificial Analysis of LMArena zou uitsluitsel geven of "frontier" een feit of een slogan is.{{/3}} En de capaciteit: {{4}}of de geclaimde 100T tokens per dag standhoudt wanneer de echte belasting erop komt.{{/4}}
Het eerlijke oordeel: Ox Alpha is een ongewoon goedkoop experiment in beide richtingen. Het platform test of een anoniem model van topklasse voor $0 in een week echt productieverkeer kan winnen; jij kunt testen of het model dat verdient. Voer het experiment uit, maar met een vangnet eronder. Tegen de tijd dat de gratis week voorbij is, is de kans groot dat we weten wie het heeft gemaakt, wat het kost en of het een plek in je stack heeft verdiend — en die drie antwoorden maken de auditie de moeite waard.
