Eine generierte Titelkarte mit der Überschrift „Unbiased's Pareto“ und dem Untertitel „Ein bezahltes 262K-Composite-Modell — und ein kostenloses, das offline gegangen ist“, über drei Karten mit den Angaben „Veröffentlicht: 17. Sep. 2026“, „Kontext: 262.144 Token“ und „Preis: 2,50 $ / 7,50 $ pro 1 Mio.“, mit einer Fußzeile „Vom Anbieter angegebene Spezifikationen, nicht geprüft; keine unabhängigen Benchmarks veröffentlicht mit Stand 18. Sep. 2026.“
Guides & Insights

Unbiaseds Pareto landet, während Union Alpha verstummt: Was tatsächlich verifiziert wurde

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Am 17. September 2026 listete ein Anbieter, der sich selbst Unbiased nennt, sein erstes und einziges Modell: Pareto, ein multimodales System mit 262.144 Token, das im Eintrag als „zusammengesetztes Modell“ beschrieben wird, zum Preis von 2,50 $ pro Million Eingabe-Token und 7,50 $ pro Million Ausgabe-Token. Etwa zweiunddreißig Stunden zuvor war ein Modell mit derselben Silhouette als Union Alpha aufgetaucht – anonym, kostenlos, ebenfalls 262K Kontext, ebenfalls 131K maximale Ausgabe, ebenfalls Text- und Bildeingabe. Stand heute führt Union Alpha null Serving-Anbieter auf. Seine Beschreibung wurde ins Präteritum umgeschrieben: „Union Alpha war ein Stealth-Modell.“ Die beiden sind offiziell nicht miteinander verbunden, und niemand hat bestätigt, dass sie dasselbe System sind. Doch die Überschneidung ist exakt genug, dass sie jetzt die nützlichste Frage zu beiden ist.

Das Folgende trennt drei Dinge, die in den wenigen Orten, an denen dieses Modell überhaupt diskutiert wird, miteinander vermischt werden: was in der Auflistung des Anbieters selbst steht, was der Kalender zeigt und was reine Vermutung bleibt. Wenn Sie diese Woche entscheiden, ob Sie für Pareto bezahlen, ist die dritte Kategorie größer, als Ihnen lieb ist.

Was Unbiaseds Pareto in seinem eigenen Listing angibt

Das überprüfbare Datenblatt ist kurz, denn der Anbieter hat kaum mehr als das veröffentlicht. Es gibt keine Modellkarte, keine Benchmark-Tabelle, keine Parameteranzahl, kein Lizenzdokument und kein Repository mit offenen Gewichten unter irgendeinem Namen – der Eintrag führt keine Hugging-Face-Kennung, was bei einem neuen Modell das klarste verfügbare Signal dafür ist, dass die Gewichte geschlossen bleiben.

• Kontextfenster — 262.144 Tokens, das volle Limit pro Anfrage, wobei keine kleinere Stufe angeboten wird • Maximale Ausgabe — 131.072 Tokens in einer einzelnen Antwort • Eingabemodalitäten — Text und Bild; Ausgabe ist nur Text, daher ist dies kein Video- oder Audiomodell • Preis — 2,50 $ pro Million Eingabe-Tokens, 7,50 $ pro Million Ausgabe-Tokens • Zwischengespeicherte Eingabe — 0,25 $ pro Million Tokens, ein Zehntel des Standard-Eingabetarifs • Anbieter — genau einer. Der Anbieter betreibt es selbst; es gibt keinen zweiten Host und daher kein Failover-Ziel innerhalb des Eintrags • Aufrufbare Parameter — max_tokens, temperature, top_p, tools und tool_choice, wobei tool_choice auf "auto" beschränkt ist

Die Architekturzeile ist die Stelle, an der das interessante Wort steht. Pareto wird als „multimodales Composite-Modell, entwickelt für Forschung, Coding und agentische Workflows, das zugleich Leistung auf Frontier-Niveau über ein breites Spektrum allgemeiner Aufgaben hinweg liefert“ beschrieben. Das ist die eigene Charakterisierung des Anbieters, und „Frontier-Niveau“ leistet darin eine Menge unbezahlter Arbeit: Kein unabhängiger Evaluator hat einen Score für dieses Modell veröffentlicht. Artificial Analysis, das Referenz-Board, das die meisten Teams prüfen, bevor sie einem neuen Namen vertrauen, hat keinen Eintrag dafür. Es gibt keine öffentliche Platzierung in einem Leaderboard, keine Messung von Latenz oder Durchsatz durch Dritte und keine Reproduktion irgendeiner Fähigkeitsaussage durch jemanden außerhalb des Anbieters.

Eine Zahl ist erwähnenswert, weil sie für den Preis ungewöhnlich groß ist. Eine maximale Ausgabelänge von 131.072 Token ist dieselbe Obergrenze, die die kostenlose Union Alpha-Vorschau hatte, und sie liegt weit über dem, was die meisten Modelle in dieser Preisklasse ausgeben. Ob diese Obergrenze in der Praxis real ist — lange Generierungen zu diesem Preis werden schnell teuer, da eine vollständige 131K-Ausgabeantwort bei $7,50 pro Million allein an Ausgabe-Tokens ungefähr $0,98 kostet — ist genau die Art von Sache, die ein unabhängiger Durchsatztest klären würde, und einen solchen gibt es nicht.

A generated single-column scoreboard titled "Unbiased's Pareto — the scoreboard" with six rows reading "Context: 262,144 tokens", "Max output: 131,072 tokens", "Input: text + image", "Price: $2.50 / $7.50 per 1M", "Providers: one (the vendor)" and "Independent scores: none yet", with a footer reading "Vendor-listed specs, unaudited; no independent scores as of Sept 18, 2026."

Die Union-Alpha-Überschneidung und warum sie kein Beweis ist

Union Alpha erschien am 16. September 2026 um 14:42 UTC als anonymes „Stealth"-Listing: ein Modell ohne namentlich genannten Entwickler, kostenlos angeboten und damals beschrieben als ein hybrides System, das für jede Anfrage mehrere Sprachmodelle parallel einbezieht, eine Antwort daraus synthetisiert und Text- und Bildeingaben über eine einzige API-Antwort entgegennimmt. Diese Beschreibung mit den parallelen Modellen wurde später zurückgestutzt, und die Fingerabdrücke des Modells sollen sich im Laufe seines kurzen Lebens verschoben haben, was Beobachter aus der Community dazu brachte, es eher als Ensemble-Router denn als konventionelles Einzelmodell zu bezeichnen. Sein Entwickler wurde nie identifiziert. Die führenden Vermutungen waren chinesische Labore und, in mindestens einer Diskussion, ein Unternehmen namens Unbiased AI — Spekulation, die geäußert wurde, weil Unbiased dafür bekannt war, an Ensemble-Ansätzen zu arbeiten, nicht weil jemand Belege gehabt hätte.

Stellt man die beiden Auflistungen nebeneinander, ist die Übereinstimmung unangenehm:

• Kontextfenster — Union Alpha 262K vs. Unbiaseds Pareto 262.144 Token • Maximale Ausgabe — 131.072 Token vs. 131.072 Token, identisch • Eingabemodalitäten — Text und Bild vs. Text und Bild, identisch • Framing — „gemischt… mehrere Sprachmodelle parallel“ vs. „zusammengesetztes Modell“ • Zeitpunkt — erstellt am 16. September, 14:42 UTC vs. erstellt am 17. September, 23:02 UTC, zweiunddreißig Stunden auseinander • Preis — während der Vorschau kostenlos vs. 2,50 $ / 7,50 $ pro Million Token • Status heute — null Serving-Anbieter vs. ein Anbieter, der Hersteller selbst

Das ist ein starker Indizienfall und nichts weiter. Identische Kontextfenster sind nicht selten; Anbieter kopieren ständig gegenseitig ihre Stufung, und 262.144 ist eine runde Zweierpotenz, die sich mehrere Modelle bereits teilen. „Composite“ und „blended“ sind beinahe Synonyme, doch sie erschienen in verschiedenen Einträgen, und der Text zu Union Alpha wurde geändert statt beibehalten. Unbiased hat nicht gesagt, dass es Union Alpha erstellt hat, auch nicht, dass es das nicht getan hat, und überhaupt keine Erklärung veröffentlicht, die dieser Artikel finden konnte. Den Zusammenhang als erwiesen zu behandeln, wäre genau die Art von Sprung, die die Berichterstattung über Union Alpha eine Woche lang unzuverlässig machte — ein Modell, dessen eigene Plattformbeschreibung zweimal bearbeitet wurde, ist keine stabile Grundlage, um irgendjemanden zu identifizieren.

A generated three-card timeline titled "Three days, two listings". The first card, "Sep 16, 2026", reads "Union Alpha appears", "Free stealth listing", "262K context"; the second, "Sep 17, 2026", reads "Unbiased's Pareto listed", "$2.50 / $7.50 per 1M", "262K context"; the third, "Sep 18, 2026", reads "Union Alpha: zero providers", "Pareto: one provider", "Link unconfirmed". A footer reads "Both listings public; any connection between them is unconfirmed as of Sept 18, 2026."

Was dich „composite“ kostet – und warum es wichtiger ist als die Benchmarks

Wenn Pareto ein Kompositum in dem Sinne ist, in dem Union Alpha beschrieben wurde – mehrere Modelle, die parallel antworten, während etwas das Ergebnis zusammenführt –, dann funktioniert die übliche Art und Weise, ein Preisblatt zu lesen, nicht mehr, und das ist der Teil der Geschichte, den keine Benchmark-Zahl beheben würde.

Ein herkömmliches Modell zu 2,50 $ pro Million Input-Tokens stellt Ihnen einen einzigen Vorwärtsdurchlauf durch einen Satz von Gewichten in Rechnung. Ein Composite, das eine Anfrage auf mehrere Modelle aufteilt und dann zusammenführt, stellt Ihnen alle diese Modelle in Rechnung, plus den Zusammenführungsschritt, und weist die Summe als einen einzigen gemischten Tarif aus. Das ist ein vollkommen legitimes Produkt – es kann jedes einzelne Modell beim Qualität-pro-Dollar-Verhältnis schlagen, wenn das Panel gut gewählt ist –, aber es bedeutet, dass der ausgewiesene Preis nichts über die tatsächlich pro Anfrage geleistete Arbeit aussagt. Daraus folgen zwei Konsequenzen für jeden, der hier Produktionsverkehr weiterleitet.

Das erste ist die Latenz. Paralleles Fan-out plus ein Synthese-Durchlauf ist langsamer als ein einzelner Aufruf, und das Listing veröffentlicht überhaupt keine Latenz- oder Durchsatzwerte. Es gibt nichts, woran Sie vor Ihrer Entscheidung Ihre eigene Toleranz prüfen können.

Der zweite Punkt ist die Kostenvorhersagbarkeit. Bei einem einzelnen Modell können Sie Ihre Rechnung aus den Token-Zahlen berechnen, die Sie sehen. Bei einem zusammengesetzten Modell kann die Anzahl der Token, die Ihnen in Rechnung gestellt wird, Arbeit von Modellen enthalten, die Sie nicht ausgewählt haben und nicht einsehen können. Caching mildert dies ab – zwischengespeicherte Eingabe zu 0,25 $ pro Million ist ein echter Rabatt –, aber nur für die Teile einer Anfrage, die sich wiederholen.

Diese Intransparenz ist die Lücke, die ein Router schließt, und sie ist die ehrliche Version unseres Angebots statt eines nachträglichen Zusatzes: Wenn Sie eigentlich ein Panel von Modellen wollen, die gemeinsam antworten, können Sie das gezielt bauen, anstatt es blind zu kaufen. OrcaRouter routet 200+ Modelle hinter einem einzigen API-Schlüssel mit 0 % Aufschlag, wobei der Listenpreis des Anbieters direkt durchgereicht wird, und seine Routing-DSL ermöglicht es Ihnen, mehrere Modelle zu einem einzigen Aufruf zusammenzusetzen, wobei der Preis jedes Teilaufrufs im Anfrageprotokoll sichtbar ist, während Modellfusion ein Panel von Modellen mit einem Prompt laufen lässt und die kombinierte Antwort zurückgibt. Sie wählen das Panel aus; Sie sehen, was jedes Mitglied gekostet hat. Wir führen Unbiaseds Pareto derzeit nicht – wenn Sie also genau dieses Modell möchten, rufen Sie es direkt über die API des Anbieters auf. Der Punkt ist nur, dass „composite“ eine Entscheidung sein sollte, die Sie treffen, und keine Eigenschaft, die Sie übernehmen.

Ein Anbieter ist das Risiko, das niemand einpreist

Die Zeile im Listing, die mehr Aufmerksamkeit verdient als die Benchmarks, ist die über das Routing: Dieses Modell wird von einem einzigen Anbieter gehostet, und Anfragen gehen direkt an ihn. Es gibt keinen zweiten Host, kein Fallback und keine Redundanz im Listing. Die Verfügbarkeitszahlen des Anbieters selbst sehen sauber aus — 100 % Uptime über den letzten Tag und die letzten dreißig Minuten —, aber ein Modell, das seit etwa einem Tag existiert, hatte noch nicht die Gelegenheit zu versagen, und ein Modell mit einem einzigen Anbieter hat keinen Mechanismus, um sich zu erholen, wenn es doch versagt.

Union Alpha führt den Punkt besser vor Augen, als jedes Argument es könnte. Am 16. September war es kostenlos, fühlte sich unbegrenzt an und war kurzzeitig sehr beliebt; wir boten es auf OrcaRouter an, solange es live war, und beschrieben es an diesem Tag als 256K-Stealth-Modell, das einen Versuch wert sei. Zwei Tage später listet es überhaupt keine Anbieter mehr, und seine Beschreibung wurde stillschweigend in die Vergangenheitsform gesetzt. Nichts daran muss zwangsläufig etwas Böses bedeuten — Preview-Fenster schließen sich, Stealth-Tests enden, und das Modell wurde vielleicht einfach in einen kostenpflichtigen Nachfolger eingegliedert. Doch die Abfolge ist das ganze Argument dafür, keine Produktionsabhängigkeit von einem Single-Endpoint-Modell aufzubauen, schon gar nicht von einem brandneuen, dessen Anbieter nur ein Produkt und keine Erfolgsbilanz vorzuweisen hat.

Automatisches Failover ist der konkrete Mechanismus, der daraus statt eines Dramas ein Nicht-Ereignis macht. Auf OrcaRouter konfiguriert man einmal eine Fallback-Kette, und eine Anfrage, die bei einem Modell fehlschlägt, wird andernorts erneut versucht, bevor die Antwort beginnt — der Aufrufer bekommt den Wechsel nie mit. Auf einen Fall wie diesen angewendet, ändert sich die Form des Fehlermodus: Ein verschwindendes Modell wird zu einer Konfigurationsänderung statt zu einem Ausfall.

A screenshot of the OrcaRouter models catalogue headed "Models" and subtitled "200 models · 16 providers · one API key, one bill", with a banner reading "New stealth model just landed on OrcaRouter - Meet Union Alpha", a "How to call any model" panel showing a POST to https://api.orcarouter.ai/v1/chat/completions, and model cards for Orca: OrcaCyber Zero 1.0, Orca: OrcaVerify Text 1.0 and DeepSeek: DeepSeek V4.1 Flash.

Was noch niemand verifiziert hat

Die Liste der offenen Fragen ist länger als die Liste der Antworten, und für ein Modell, für das man bezahlen soll, ist genau diese Asymmetrie die Story. Ob Unbiased Union Alpha erstellt hat, ist unbestätigt. Was Paretos Composite tatsächlich zusammensetzt – welche Modelle, wie viele und nach welcher Auswahlregel –, wird nicht offengelegt. Ob es Prompts speichert und wie lange, wird im Listing in keiner Form angegeben, die dieser Beitrag finden konnte. Ob die Tarife von $2.50 und $7.50 Einführungstarife sind, ist unbekannt; das Listing enthält keinen Aktionshinweis und kein genanntes Enddatum, aber ein Preis, der erst einen Tag alt ist, ist keine Zusage. Ob das Modell selbst in einem Monat noch existieren wird, ist – allein aufgrund der Evidenz der letzten drei Tage – eine wirklich offene Frage. Und ob es bei den Aufgaben, für die es wirbt – Recherche, Programmierung und agentische Workflows –, etwas taugt, hat niemand getestet, der seine Methode veröffentlicht.

Es gibt außerdem eine strukturelle Frage, die die Überschneidung aufwirft und die niemand beantwortet hat: Wenn eine kostenlose anonyme Vorschau und ein bezahltes benanntes Produkt dasselbe System sind, dann war die Vorschau ein Preisexperiment, und das Community-Fingerprinting, das die Identitätsdebatte speiste, wurde an einem Modell durchgeführt, dessen Zusammensetzung sich darunter veränderte. Das würde keines der beiden Produkte unehrlich machen. Es würde bedeuten, dass der Evaluationsdiskurs um Stealth-Modelle etwas misst, das sich bewegt.

Wer sollte handeln, und wer sollte warten?

Wenn Sie heute ein multimodales Modell mit 262K-Kontext brauchen und der Preis angesichts Ihres Budgets trivial ist, ist Pareto jetzt aufrufbar und die Bedingungen sind veröffentlicht – ein erst einen Tag altes Modell mit einem Anbieter ist eine vernünftige Sache, die man hinter einer Fallback-Kette testet, und eine schlechte Sache, die man vor Umsatzverkehr setzt. Bezahlen Sie eine Woche echter Arbeit, messen Sie Ihre eigene Latenz und Ihre Kosten pro Aufgabe und vergleichen Sie die Gesamtsumme mit dem Routing der zugrunde liegenden Modelle selbst, wo die Arithmetik zumindest lesbar ist.

Wenn Ihr Interesse der kostenlosen Vorschau von Union Alpha galt, ist diese Tür seit heute geschlossen, und es wurde keine Aussage darüber gemacht, ob das Bezahlmodell dieselbe Sache unter einem Namen ist. Die verantwortungsvolle Lesart ist, dass eine Vorschau endete und ein Produkt begann und dass die Verbindung zwischen ihnen eine Hypothese mit starken Indizien und keinerlei Bestätigung ist.

Was diese Lesart ändern würde, ist unspektakulär und konkret: eine Anbieteraussage, die Union Alpha nennt, ein unabhängiger Benchmark mit einer veröffentlichten Methode oder ein zweiter Anbieter, der gegen das Modell antritt. Bis eines davon eintritt, ist die ehrliche Zusammenfassung von Unbiaseds Pareto ein gut spezifiziertes Preisblatt, das an ein System angehängt ist, das kein Außenstehender gemessen hat — und genau deshalb gehört es hinter einen Router statt ganz vorne in Ihrem Stack.