
Pareto van Unbiased verschijnt terwijl Union Alpha offline gaat: wat daadwerkelijk is geverifieerd
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Op 17 september 2026 publiceerde een leverancier die zichzelf Unbiased noemt zijn eerste en enige model: Pareto, een multimodaal systeem met 262.144 tokens dat in de vermelding wordt omschreven als een "composietmodel", met een prijs van $2,50 per miljoen inputtokens en $7,50 per miljoen output. Ongeveer tweeëndertig uur eerder was een model met hetzelfde silhouet verschenen als Union Alpha — anoniem, gratis, ook 262K context, ook 131K maximale output, ook tekst en beeld als invoer. Vanaf vandaag vermeldt Union Alpha nul aanbieders die het model serveren. De beschrijving is herschreven in de verleden tijd: "Union Alpha was een stealthmodel." De twee zijn niet officieel verbonden, en niemand heeft bevestigd dat ze hetzelfde systeem zijn. Maar de overlap is zo exact dat het nu de nuttigste vraag is over een van beide.
Wat volgt scheidt drie dingen die op de weinige plekken waar dit model überhaupt wordt besproken door elkaar worden gehaald: wat de eigen vermelding van de leverancier stelt, wat de kalender laat zien, en wat pure inferentie blijft. Als je deze week overweegt om voor Pareto te betalen, is de derde categorie groter dan je zou willen.
Wat Unbiased' Pareto op zijn eigen vermelding vermeldt
Het verifieerbare specificatieblad is kort, omdat de leverancier vrijwel niets anders dan dat heeft gepubliceerd. Er is geen modelkaart, geen benchmarktabel, geen parameteraantal, geen licentiedocument en geen open-weightsrepository onder welke naam dan ook — de vermelding bevat geen Hugging Face-identifier, wat voor een nieuw model het duidelijkste beschikbare signaal is dat de gewichten gesloten blijven.
• Contextvenster — 262,144 tokens, de volledige limiet per verzoek, zonder een kleinere variant • Maximale uitvoer — 131,072 tokens in één enkele respons • Invoermodaliteiten — tekst en afbeelding; uitvoer is alleen tekst, dus dit is geen video- of audiomodel • Prijs — $2,50 per miljoen invoertokens, $7,50 per miljoen uitvoertokens • Gecachte invoer — $0,25 per miljoen tokens, een tiende van het standaard invoertarief • Aanbieders — precies één. De leverancier host het zelf; er is geen tweede host en dus geen failover-doel binnen de vermelding • Aanroepbare parameters — max_tokens, temperature, top_p, tools en tool_choice, waarbij tool_choice beperkt is tot "auto"
De regel over de architectuur is waar het interessante woord staat. Pareto wordt beschreven als een "multimodaal samengesteld model dat is gebouwd voor onderzoek, coderen en agentische workflows, en tegelijk prestaties op frontier-niveau levert voor een breed scala aan algemene taken." Dat is de eigen karakterisering van de leverancier, en "frontier-niveau" doet daarin veel onbetaald werk: geen enkele onafhankelijke evaluator heeft een score voor dit model gepubliceerd. Artificial Analysis, het referentieboard dat de meeste teams raadplegen voordat ze een nieuwe naam vertrouwen, heeft er geen vermelding voor. Er is geen openbare notering op een leaderboard, geen meting van latentie of doorvoer door een derde partij, en geen reproductie van welke capaciteitsclaim dan ook door iemand buiten de leverancier.
Eén getal is het vermelden waard omdat het ongewoon groot is voor de prijs. Een maximale uitvoer van 131.072 tokens is hetzelfde plafond dat de gratis Union Alpha-preview had, en het ligt ver boven wat de meeste modellen in deze prijsklasse zullen produceren. Of dat plafond in de praktijk echt is — lange generaties worden tegen dit tarief snel duur, want een volledige uitvoerrespons van 131K tegen $7,50 per miljoen kost alleen al ongeveer $0,98 aan uitvoertokens — is precies het soort kwestie dat een onafhankelijke doorvoertest zou beslechten, en die bestaat niet.

De Union Alpha-overlap, en waarom het geen bewijs is
Union Alpha verscheen op 16 september 2026 om 14:42 UTC als een anonieme "stealth"-vermelding: een model zonder genoemde ontwikkelaar, gratis aangeboden, destijds beschreven als een gecombineerd systeem dat voor elk verzoek meerdere taalmodellen parallel inzet, één antwoord synthetiseert en via één API-respons tekst- en visuele invoer accepteert. Die beschrijving van parallelle modellen werd later ingekort, en naar verluidt veranderden de vingerafdrukken van het model gedurende zijn korte bestaan, waardoor waarnemers in de community het een ensemblerouter gingen noemen in plaats van een conventioneel enkel model. De ontwikkelaar ervan werd nooit geïdentificeerd. De voornaamste vermoedens waren Chinese labs en, in ten minste één discussie, een organisatie genaamd Unbiased AI — speculatie die werd geopperd omdat Unbiased bekendstond om werk aan ensemblebenaderingen, niet omdat iemand bewijs had.
Zet de twee lijsten naast elkaar en de overeenkomst is ongemakkelijk:
• Contextvenster — Union Alpha 262K vs de Pareto van Unbiased 262.144 tokens • Maximale output — 131.072 tokens vs 131.072 tokens, identiek • Inputmodaliteiten — tekst en afbeelding vs tekst en afbeelding, identiek • Framing — "blended… meerdere taalmodellen parallel" vs "samengesteld model" • Timing — aangemaakt op 16 september, 14:42 UTC vs aangemaakt op 17 september, 23:02 UTC, tweeëndertig uur uit elkaar • Prijs — gratis tijdens de preview vs $2,50 / $7,50 per miljoen tokens • Status vandaag — nul aanbieders die het model serveren vs één aanbieder, de leverancier zelf
Dat is een sterke indirecte bewijsketen en niets meer. Identieke contextvensters zijn niet zeldzaam; leveranciers kopiëren voortdurend elkaars tierindeling, en 262.144 is een rond getal dat een macht van twee is en dat meerdere modellen al delen. "Composite" en "blended" zijn bijna synoniemen, maar ze verschenen in verschillende vermeldingen, en de tekst over Union Alpha werd gewijzigd in plaats van behouden. Unbiased heeft niet gezegd dat het Union Alpha heeft gemaakt, heeft niet gezegd dat het dat niet heeft gedaan, en heeft helemaal geen verklaring gepubliceerd die dit stuk heeft kunnen vinden. De link als vaststaand behandelen zou precies het soort sprong zijn dat de verslaggeving over Union Alpha een week lang onbetrouwbaar maakte — een model wiens eigen platformbeschrijving tweemaal is bewerkt, is geen stabiele basis om wie dan ook te identificeren.

Wat "composite" je kost, en waarom het meer uitmaakt dan de benchmarks
Als Pareto een composiet is in de zin waarin Union Alpha werd beschreven — meerdere modellen die parallel antwoorden, met iets dat het resultaat synthetiseert — dan werkt de gebruikelijke manier om een prijslijst te lezen niet meer, en dat is het deel van het verhaal dat geen enkel benchmarkcijfer zou verhelpen.
Een conventioneel model van $2,50 per miljoen inputtokens factureert je voor één forward pass door één set gewichten. Een composiet dat een verzoek uitsplitst naar meerdere modellen en vervolgens synthetiseert, factureert je voor allemaal, plus de synthesestap, en rapporteert het totaal als één enkel gecombineerd tarief. Dat is een volkomen legitiem product — het kan elk afzonderlijk model verslaan op kwaliteit per dollar wanneer het panel goed wordt gekozen — maar het betekent dat de headline-prijs je niets zegt over het werkelijke werk dat per verzoek wordt verricht. Hieruit volgen twee consequenties voor iedereen die hier productieverkeer naartoe routeert.
Het eerste is latentie. Parallelle fan-out plus een syntheseronde is langzamer dan één enkele aanroep, en de listing publiceert helemaal geen latentie- of doorvoercijfers. Er is niets om aan je eigen tolerantie te toetsen voordat je je vastlegt.
Het tweede is kostenvoorspelbaarheid. Met één enkel model kun je je factuur berekenen op basis van tokenaantallen die je kunt zien. Bij een composiet kan het aantal tokens waarvoor je wordt gefactureerd, werk van modellen omvatten die je niet hebt gekozen en niet kunt inspecteren. Caching verzacht dit — gecachte invoer tegen $0,25 per miljoen is een echte korting — maar alleen voor de delen van een verzoek die zich herhalen.
Die ondoorzichtigheid is het gat dat een router dicht, en het is de eerlijke versie van onze pitch in plaats van een later aangebouwd extraatje: als wat je eigenlijk wilt een panel van modellen is die samen antwoorden, dan kun je dat bewust bouwen in plaats van het blind te kopen. OrcaRouter routeert 200+ modellen achter één API-sleutel met 0% opslag, geeft de lijstprijs van de provider ongewijzigd door, en met de routing-DSL kun je meerdere modellen samenstellen tot één aanroep, waarbij de prijs van elk onderdeel zichtbaar is in het verzoeklog, terwijl model fusion een panel van modellen op één prompt loslaat en het gecombineerde antwoord teruggeeft. Jij kiest het panel; je ziet wat elk lid heeft gekost. We hebben Unbiased's Pareto momenteel niet — dus als je dit specifieke model wilt, roep het dan rechtstreeks aan via de eigen API van de leverancier. Het punt is alleen dat "composite" een beslissing moet zijn die je zelf neemt, niet een eigenschap die je ondergaat.
Eén provider is het risico dat niemand inprijst
De regel in de listing die meer aandacht verdient dan de benchmarks, is die over routing: dit model wordt gehost door één enkele provider, en verzoeken gaan er rechtstreeks naartoe. Er is geen tweede host, geen fallback en geen redundantie in de listing. De beschikbaarheidscijfers van de leverancier zelf zien er netjes uit — 100% uptime over de afgelopen dag en de afgelopen dertig minuten — maar een model dat ongeveer een dag bestaat, heeft nog niet de kans gehad om te falen, en een model met één provider heeft geen mechanisme om te herstellen wanneer dat gebeurt.
Union Alpha maakt de zaak duidelijker dan welk argument dan ook. Op 16 september was het gratis, voelde het onbeperkt en was het kortstondig erg populair; we hebben het op OrcaRouter gehost zolang het live was en schreven er die dag over als een 256K-stealthmodel dat het proberen waard was. Twee dagen later vermeldt het helemaal geen providers meer, en de beschrijving ervan is stilletjes in de verleden tijd gezet. Niets daaraan is noodzakelijkerwijs onheilspellend — previewvensters sluiten, stealthtests eindigen, en het model is misschien simpelweg opgegaan in een betaalde opvolger. Maar de opeenvolging is het hele argument om geen productieafhankelijkheid te bouwen op een single-endpointmodel, vooral niet op een gloednieuw model waarvan de leverancier één product heeft en geen staat van dienst.
Automatische failover is het specifieke mechanisme dat dit van een drama in een non-event verandert. Op OrcaRouter configureer je een fallback-keten één keer, en een verzoek dat bij het ene model mislukt, wordt elders opnieuw geprobeerd voordat het antwoord begint — de aanroeper ziet de wissel nooit. Toegepast op een geval als dit verandert de faalmodus van vorm: een model dat verdwijnt wordt een configuratiewijziging in plaats van een storing.

Wat niemand nog heeft geverifieerd
De lijst met open vragen is langer dan de lijst met antwoorden, en voor een model waarvoor je wordt gevraagd te betalen, is die asymmetrie het verhaal. Of Unbiased Union Alpha heeft gemaakt, is niet bevestigd. Wat Pareto's composite werkelijk samenstelt — welke modellen, hoeveel, en volgens welke selectieregel — wordt niet bekendgemaakt. Of het prompts bewaart, en hoe lang, wordt op de listing in geen enkele vorm vermeld die dit stuk kon vinden. Of de tarieven van $2,50 en $7,50 introductietarieven zijn, is onbekend; de listing bevat geen promotionele vermelding en geen vermelde einddatum, maar een prijs van één dag oud is geen toezegging. Of het model zelf over een maand nog bestaat, is, op basis van alleen de aanwijzingen van de laatste drie dagen, een echte open vraag. En of het goed presteert op de taken die het claimt — onderzoek, coderen en agentische workflows — is door niemand die zijn methode publiceert getest.
Er is ook een structurele vraag die de overlap oproept en die niemand heeft beantwoord: als een gratis anonieme preview en een betaald product met een naam hetzelfde systeem zijn, dan was de preview een prijsexperiment, en de community-fingerprinting die de identiteitsdiscussie voedde, werd uitgevoerd op een model waarvan de samenstelling eronder veranderde. Dat zou geen van beide producten oneerlijk maken. Het zou betekenen dat het evaluatiediscours rond stealthmodellen iets meet dat beweegt.
Wie moet handelen, en wie moet wachten?
Als je vandaag een multimodaal model met 262K-context nodig hebt en de prijs verwaarloosbaar is ten opzichte van je budget, is Pareto nu aanroepbaar en zijn de voorwaarden gepubliceerd — een model van één dag oud met één provider is een redelijk iets om achter een fallback-keten te testen, en een slecht idee om vóór omzetverkeer te zetten. Betaal voor een week echt werk, meet je eigen latentie en kosten per taak, en vergelijk het totaal met het zelf routeren van de onderliggende modellen, waar de rekensom tenminste leesbaar is.
Als je belangstelling uitging naar de gratis Union Alpha-preview, dan is die deur vanaf vandaag dicht, en er is geen verklaring afgelegd over of het betaalde model hetzelfde ding is, maar dan met een naam. De verantwoorde lezing is dat een preview eindigde en een product begon, en dat het verband daartussen een hypothese is met sterke indirecte ondersteuning en nul bevestiging.
Wat die interpretatie zou veranderen, is weinig glamoureus en heel specifiek: een leveranciersverklaring die Union Alpha noemt, een onafhankelijke benchmark met een gepubliceerde methode, of een tweede aanbieder die tegenover het model opduikt. Tot een van die dingen zich aandient, is de eerlijke samenvatting van Unbiased' Pareto een goed gespecificeerde prijslijst die aan een systeem hangt dat geen buitenstaander heeft gemeten — en dat is precies waarom het achter een router thuishoort en niet vooraan in je stack.
