Hero-Bereich für Solar Pro 4 vs. Solar Open 2 250B: Er stellt Upstages geschlossene, gehostete API Solar Pro 4 (10. August 2026) dem selbst gehosteten Solar Open 2 250B mit offenen Gewichten (22. Juli 2026) gegenüber, mit dem Schlagzeilen-Kontrast „heute aufrufen vs. selbst betreiben“.
Engineering & Research

Solar Pro 4 vs. Solar Open 2 250B: Upstages zwei Flaggschiffe, in der Mitte geteilt

Autor

Jim Song

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Upstage lieferte innerhalb von drei Wochen zwei verschiedene Antworten auf dieselbe Frage, und keine davon ist eine Version der anderen. Solar Open 2 250B, das am 22. Juli als offene Gewichte veröffentlicht wurde, ist das Vorzeigemodell des Unternehmens für souveräne KI: 250B Gesamtparameter mit etwa 15B aktiven Parametern pro Token, einem angegebenen 1M-Token-Kontext und einer Lizenz, die es dir erlaubt, es auszuführen und zu modifizieren. Solar Pro 4, das am 10. August kommerziell eingeführt wurde, ist das Flaggschiff mit geschlossenen Gewichten: 524K Kontext, $0.03 pro Million Eingabe-Token und $0.12 pro Million Ausgabe-Token, und null Absicht, Gewichte zu veröffentlichen. Dasselbe Unternehmen, dieselbe agentische These, gegensätzliche Distributionsstrategien — und der Unterschied ist kein Detail, er ist die ganze Geschichte. Denn ab dieser Woche ist eines dieser Modelle trivial einfach aufzurufen und das andere ist bekanntermaßen schwierig, es überhaupt auszuführen.

Das Familienargument

Beide Modelle gehören zur Solar-Familie von Upstage, die das Unternehmen ausdrücklich „für agentenbasierte Anwendungen“ neu ausgerichtet hat. Die beiden verkörpern die Spaltung in Upstages Strategie: Solar Open 2 250B existiert, um die souveräne KI-Fähigkeit Koreas offen zu beweisen – Benchmark-Ergebnisse, technischer Bericht, Hugging-Face-Gewichte, kommerzielle Lizenz – während Solar Pro 4 existiert, um das profitable, geschlossene, gehostete Flaggschiff zu sein. In einer rationalen Welt wären diese dasselbe Modell mit unterschiedlicher Lizenzierung. In der Praxis hat Upstage das offene Modell als Forschungs- und Souveränitätsstatement gebaut und das Pro-Modell als Produkt. Dieser Artikel vergleicht sie auf die einzig faire Art: als zwei Bereitstellungsoptionen mit demselben Elternhaus, wobei der entscheidende Faktor ist, was man mit jedem tatsächlich tun kann.

Screenshot of the Upstage Console models page showing the banner 'Solar Pro 4 is live. Free through August 10'.

Wo sie sich wirklich unterscheiden

• Gewichte — Solar Open 2 250B: offen, auf Hugging Face (upstage/Solar-Open2-250B); Solar Pro 4: geschlossen, nur API

• Skalierung — Solar Open 2 250B: 250,29B insgesamt, ~15B aktiv pro Token; Solar Pro 4: Parameterzahl nicht offengelegt

Kontext — Solar Open 2 250B: 1.048.576 Token angegeben; Solar Pro 4: 524K Token

• Lizenz — Solar Open 2 250B: Upstage Solar License (basierend auf Apache-2.0, mit einer „Solar“-Namens-/Attributionszeichenkette); Solar Pro 4: proprietär

• Preis — Solar Open 2 250B: Sie hosten es, die Kosten sind also Ihre GPUs; Solar Pro 4: $0.03/$0.12 pro 1M, pro Token abgerechnet

• Belege — beides: vom Anbieter gemeldete Benchmark-Tabellen; für keines liegt Stand dieser Woche eine unabhängige Laborreproduktion vor.

Comparison scoreboard for Solar Pro 4 and Solar Open 2 250B: price $0.03/$0.12 per 1M vs your own GPUs, context 524K vs 1M claimed, parameters undisclosed vs 250B (~15B active), weights closed vs open on Hugging Face, hosted endpoint yes vs none, independent score none vs none, with footer noting both are Upstage-reported and neither independently reproduced as of August 2026.

Diese letzte Zeile ist wichtig. Die Ergebnisse von Solar Open 2 250B – MMLU-Pro 86,2, LiveCodeBench v6 92,4, APEX-Agents 16,6, ein koreanischer Durchschnitt von 85,4 – stammen aus dem eigenen technischen Bericht von Upstage, der zusammen mit den Gewichten veröffentlicht wurde. Die Aussagen zu Solar Pro 4 stammen aus Launch-Material mit noch weniger Details. Die Zahlen keines der beiden Modelle wurden unabhängig reproduziert. Der Unterschied besteht darin, dass der Bericht von Solar Open 2 250B ein 30-seitiges Dokument ist, das man lesen kann; die „Verbesserungen beim Denken über lange Dokumente, bei der mehrschrittigen Werkzeugnutzung und bei der Leistung bei Terminal-Aufgaben“ von Solar Pro 4 sind ein Satz in einer Pressemitteilung.

Der Teil, den alle falsch herum verstehen.

Die allgemeine Annahme ist, dass offene Gewichte einfacher zu verwenden sind als eine geschlossene API. Beim Solar Open 2 250B ist das Gegenteil der Fall. Die Modellkarte ist eindeutig: „Dieses Modell wird von keinem Inference-Provider bereitgestellt." Es existiert kein gehosteter Endpoint. Die bfloat16-Gewichte umfassen 500,6 GB – vier H200s als angegebenes Minimum, acht empfohlen – und der Serving-Stack ist kein Standard-vLLM: Die architektonischen Entscheidungen, die den Betrieb bei langem Kontext kostengünstig machen (lineare Aufmerksamkeit in drei Vierteln der Schichten, kein RoPE), sind genau die Entscheidungen, für die allgemeine Inferenzsoftware keinen Codepfad besitzt. Quantisierte Builds (Nota AIs NVFP4 mit 153,3 GB) verkleinern den Speicher, binden einen aber an Blackwell-Hardware und einen Fork von vLLM. Dies ist ein Modell, das man selbst aufsetzt, und „aufsetzen" leistet in diesem Satz echte Arbeit.

Solar Pro 4 hingegen ist eine gehostete API mit einem kostenlosen Testzeitraum, der gerade am 10. August abgelaufen ist. Sie melden sich an, Sie erhalten einen Schlüssel, Sie rufen ihn auf. Das ist der gesamte Unterschied in einer Zeile: Solar Open 2 250B ist ein Projekt; Solar Pro 4 ist ein Produkt. Für ein Team, das heute einfach nur ein agentisches Modell möchte, ist „ein Projekt“ ein Kostenfaktor, kein Feature.

Screenshot of the Hugging Face model card for upstage/Solar-Open2-250B showing the line 'This model isn''t deployed by any Inference Provider', with 740 likes and download counts.

Wofür jedes einzelne tatsächlich da ist

Solar Open 2 250B ist für Organisationen, die das Modell besitzen möchten: {{1}}Datenresidenz-Anforderungen, Sovereign-AI-Vorgaben, ein GPU-Cluster mit ungenutzter Kapazität oder eine langfristige Kostenkurve{{/1}}, bei der „Grenzkosten pro Token“ mehr zählen als die heutige Preisliste. {{2}}Die koreanische Sprachqualität ist ein echtes Unterscheidungsmerkmal{{/2}} — der Tokenizer benötigt nur 50–80 % der Token, die globale Modelle für denselben koreanischen Text brauchen, und Ko-GDPval liegt haarscharf an DeepSeek-V4-Pro. {{3}}Wenn Sie koreanische Nutzer in großem Maßstab auf eigener Hardware bedienen, ist das der Grund, warum dieses Modell existiert.{{/3}}

Solar Pro 4 ist für alle anderen: das Team, das agentisches Verhalten, Long-Context-Reasoning und einen 50–250-fachen Preisvorteil gegenüber der Spitzenklasse möchte, ohne eine einzige GPU zu betreiben. Es ist die pragmatische Antwort auf „Ich möchte Solars agentische Ausrichtung, aber nicht das Infrastrukturprojekt." Der Kompromiss ist Dauerhaftigkeit — man besitzt es nie — und Verifizierung — man hat bisher nur Upstages Wort zur Qualität.

Es gibt eine dritte Position, die die Wahl umgeht. Solar Pro 4 läuft auf Upstages eigener API und mehreren Plattformen von Drittanbietern, sodass Sie nicht an das Bereitstellungsmodell eines einzelnen Anbieters gebunden sind – und eine Routing-Ebene ist es, die das portabel macht: eine API für über 200 Modelle zum Listenpreis des Anbieters, ohne Aufschlag, automatisches Failover und eine Konfigurationsänderung statt einer Neuimplementierung, wenn Sie eine Arbeitslast auf ein anderes Modell verlagern möchten. An dem Tag, an dem ein unabhängiger Benchmark Upstages Behauptungen widerspricht, können Sie den Datenverkehr, der Upstage vertraut, umleiten. Genau darum geht es, Ihre Architektur nicht an die Tarifkarte eines Anbieters zu binden: Die Routing-Ebene macht die Wette widerrufbar.

Fazit

{{1}}Solar Open 2 250B{{/1}} ist das ehrgeizigere und das schwieriger zu nutzende Modell. {{2}}Solar Pro 4{{/2}} ist das bequemere und dasjenige, das man tatsächlich aufrufen kann. Wenn man GPUs und einen Grund hat, das Modell zu besitzen – insbesondere für koreanischsprachige Arbeit –, ist das offene Schwestermodell die Antwort, und die 1M-Kontext-Behauptung ist das, was man selbst überprüfen sollte. {{3}}Wenn man heute Nachmittag ein agentisches Flaggschiff möchte, ist das geschlossene Flaggschiff die Antwort{{/3}}, preislich wie ein Rundungsfehler und so unerprobt wie ein Modell der Markteinführungswoche. Keines ersetzt das andere, und genau das ist bei Upstage eindeutig Absicht: ein Modell, um Können zu demonstrieren, eines, um es zu verkaufen.

© 2026 OrcaRouter

Für Anbieter

Sie betreiben eine Inferenz-Plattform? Bringen Sie Ihre Modelle auf OrcaRouter.

Kontaktieren Sie uns

Community beitreten

DiscordEmailXGitHubYouTube