Eine Hero-Titelkarte für Upstage Solar Pro 4 mit der Aufschrift „Solar Pro 4 — Upstages Agent-First-Flaggschiff, live am 10. August 2026", mit Statistik-Chips für „524K Kontext", „$0,30 / $1,20 pro 1M Tokens" und „Agent-First-Design" auf weißem Hintergrund mit blauen und cyanfarbenen Akzenten. OrcaRouter-Logo unten rechts eingefügt.
Engineering & Research

Solar Pro 4 erzielt 42: Upstages Agent-First-Flaggschiff, jetzt unabhängig gemessen

Autor

Rowan Sterling

Veröffentlicht am

Neueste Modelle · 20Alle Modelle ansehen
Benchmarks: Artificial Analysis · täglich aktualisiert
Zurück zu allen Beiträgen

Upstage Solar Pro 4 ging am 10. August 2026 live, und die erste Zahl, die man sich ansehen sollte, war der Preis: 0,30 $ pro Million Input-Tokens und 1,20 $ pro Million Output-Tokens in Upstages eigener API, mit einem Einführungsangebot, das das auf 0,03 $ und 0,12 $ senkt – 90 % Rabatt – in den aktuellen Angeboten. Vier Tage später kam die zweite Zahl, die man sich ansehen sollte. Am 12. August 2026 veröffentlichte Artificial Analysis die erste unabhängige Bewertung von Solar Pro 4 und bewertete es mit 42 auf seinem Intelligence Index, gegenüber 14 für Solar Pro 3 – eine Verdreifachung des gemessenen Ergebnisses im Vergleich zum Vorgänger und ein Sprung um 27 Punkte nach der eigenen Arithmetik des Labors – was Upstages Positionierung von Solar Pro 4 als proprietäres Flaggschiff bestätigt, das Modell, das Solar Pro 3 an der Spitze der Produktlinie ersetzt. Wie auch immer, günstig; jetzt auch unabhängig gemessen.

Was tatsächlich ausgeliefert wurde

{{1}}Solar Pro 4 ist das kommerzielle Flaggschiff von Upstages Wende zur Agenten-Ära.{{/1}} {{2}}Das Unternehmen hat 2026 damit verbracht, die Solar-Produktlinie rund um agentische Workloads neu aufzubauen — sein Open-Weight-Pendant Solar Open 2 erschien Ende Juli — und Solar Pro 4 ist das gehostete Produkt, auf das diese Wende abzielte.{{/2}} {{3}}Upstage fasst es in einem Satz zusammen: ein Modell für Aufgaben, die anhaltenden Kontext, mehrstufige Ausführung und einen Ende-zu-Ende-Abschluss erfordern, statt einmaliger Antworten.{{/3}}

Konkret beschreibt die Modellseite es als Upstages Flaggschiff-Modell, das speziell für agentischen Einsatz entwickelt wurde und sich für agentische Workflows, Büroproduktivität, dokumentintensive Arbeit und Programmierung eignet. Auf dem Papier ist es der größte Kontext, den die Reihe je ausgeliefert hat – Solar Pro 3 bot 128K – und das bisher einzige Solar-Modell mit einer veröffentlichten Reasoning-Geschichte und einer Tool-Calling-Oberfläche, die auf autonome Agenten ausgerichtet ist.

Technische Daten wie zum Start aufgeführt:

• Kontextfenster — 524.288 Tokens (524K) in der Auflistung des Anbieters, etwa das Vierfache der 128K der vorherigen Generation; die unabhängige Messung von Artificial Analysis verzeichnet 384K, daher ist die größere Zahl als Upstages Angabe zu betrachten.

• Preis — offizieller Upstage-API-Tarif: 0,30 $ pro 1M Eingabe-Tokens / 1,20 $ pro 1M Ausgabe-Tokens, mit gecachtem Input bei 0,06 $; ein Einführungsangebot bietet es mit 90 % Rabatt für 0,03 $ / 0,12 $ in den aktuellen Angeboten.

• Fähigkeiten — logisches Denken, Funktionsaufrufe, JSON-Modus, Streaming und Websuche, mit Unterstützung für Bildeingabe

• Weights — proprietär, nicht offen; keine Veröffentlichung auf Hugging Face (im Gegensatz zum offenen Solar Open 2)

• Zugriff — Upstage Console API sowie mehrere Drittanbieter-Plattformen; eine Chat-App unter solar-chat.upstage.ai für praktische Tests

Diese Zahlen stammen aus der Auflistung des Anbieters, nicht aus einem geprüften Datenblatt – und die erste unabhängige Messung widerspricht nun einer davon. Artificial Analysis verzeichnet für Solar Pro 4 ein Kontextfenster von 384K Token und eine maximale Ausgabe von 256K, gegenüber den 524K und 128K–131K, die der Anbieter angibt. Die Liste der Fähigkeiten und Upstages eigene Kontextangabe stammen von der Modellseite; die AA-Zahlen sind die unabhängige Messung.

A single-column scoreboard for Solar Pro 4 listing a 524K context window, list price of $0.30 / $1.20 per 1M tokens with a 90% launch promo, proprietary weights, reasoning/tool-use/vision capabilities, and no independent benchmarks yet, with a sourcing footer noting the vendor listing of Aug 10, 2026. OrcaRouter logo composited bottom-right.The Upstage console models page in English, showing the banner 'Solar Pro 4 is live' with free access through August 10 and the model catalog sidebar, captured August 11, 2026.

Was hat sich gegenüber Solar Pro 3 geändert — die ersten unabhängigen Zahlen.

Upstages eigene Behauptungen für Solar Pro 4 konzentrieren sich auf drei Verbesserungsbereiche gegenüber Solar Pro 3, die alle für Agenten relevant sind: Reasoning über lange Dokumente, mehrstufige Tool-Nutzung und Leistung bei Terminal-Aufgaben. Genau das sind die Dimensionen, in denen ein Agentenmodell seinen Wert beweist – einen Faden über ein langes Dokument hinweg aufrechtzuerhalten, eine Sequenz von Tool-Aufrufen durchzuhalten, ohne den Überblick zu verlieren, und Aufgaben abzuschließen, die in einer Shell laufen.

Der erste unabhängige Lauf stützt die Richtung all dieser Behauptungen. Artificial Analysis bewertete Solar Pro 4 mit 42 auf seinem Intelligence Index, gegenüber 14 für Solar Pro 3, und die größten Zugewinne liegen genau dort, worauf Upstage hingewiesen hat:

• Terminal-Bench v2.1 (Terminal-Aufgaben): 12% → 57%

• AA-LCR (Long-Context-Reasoning): 31 % → 71 %

• τ³-Banking (mehrschrittige Tool-Nutzung): 9% → 23%

• GDPval-AA v2 (reale agentische Arbeit): Elo 498 → 1,277, über der menschlichen Basislinie von 1,000 und leicht vor Qwen3.7 Max (1,272) und MiMo-V2.5-Pro (1,266)

{{1}}Die Indexplatzierung ist die Schlagzeile: 42 steht neben Inkling (xhigh, 42) und knapp hinter MiMo-V2.5-Pro (43).{{/1}} {{2}}Ein Modell, das wie eine Budget-Klasse bepreist ist, misst sich nun wie ein ernstzunehmender Agent.{{/2}}

Zwei Einschränkungen gingen mit dem Ergebnis einher. Die Verbesserung bei AA-Omniscience (-53 → -1) ist größtenteils auf Enthaltung zurückzuführen: Solar Pro 4 versucht nur 41 % der Fragen zu beantworten, gegenüber 92 % bei Solar Pro 3. Die Halluzinationsrate sank von 88 % auf 24 %, aber die Genauigkeit blieb unverändert bei 19 %. Und der Intelligenzzuwachs kostete Latenz – etwa 8,6 Minuten pro Intelligence-Index-Aufgabe gegenüber 6,0 Minuten bei Solar Pro 3, während sich der Token-Verbrauch von etwa 52.000 auf 43.000 Ausgabe-Token pro Aufgabe verbesserte. Es ist ein klügeres, vorsichtigeres, langsameres Modell.

Warum der Preis wichtiger ist als die Specs

Das Argument für Solar Pro 4 ist sein Verhältnis von Preis zu gemessener Intelligenz. Selbst zum offiziellen Listenpreis unterbietet ein Modell mit 384K–524K-Kontext für 0,30 $ pro Million Input-Tokens praktisch das gesamte Feld – etwa ein Sechzehntel des Input-Preises eines Top-Flaggschiffs – und die Aktion mit 90 % Rabatt senkt das auf ein Sechzehntel von einem Sechzehntel. Das landet in einem Bereich, in dem der Markt derzeit kleine schnelle Modelle verkauft, keine agentenfähigen mit einem verifizierten mittleren Score.

The Upstage Solar Pro 4 model page in English, titled 'Solar Pro 4 — Upstage's flagship model, specialized for agentic use', listing input pricing of $0.30 per 1M tokens, output $1.20 per 1M, and cached input $0.06 per 1M, with intelligence and speed controls, captured August 11, 2026.

Die skeptische Position ist nicht mehr, dass Solar Pro 4 unbewiesen ist — der AA-Lauf klärt das — sondern dass es echt ist. Der Zuwachs an Allwissenheit ist teilweise ein Verweigerungsmuster, nicht nur Wissen. Die gemessene Latenz ist ein Rückschritt gegenüber Solar Pro 3. Der 384K-Kontext von Artificial Analysis liegt unter den vom Anbieter beworbenen 524K. Und das „90 % off“-Abzeichen bedeutet, dass sich der künftige Preis nach Ablauf des Aktionszeitraums ändern kann — der dauerhafte Preis ist der Listenpreis von 0,30 $ / 1,20 $, nicht das Preisschild von 0,03 $ / 0,12 $.

Wer es ausprobieren sollte, wer warten sollte

Probieren Sie es jetzt aus, wenn: Sie einen Agenten prototypen und Token die dominierenden Kosten sind, Sie ein langes Kontextfenster benötigen und Ihre Arbeitslast langsameres Denken toleriert, oder Sie koreanischsprachige und ostasiatische Dokument-Workloads auswerten, bei denen Upstage durchweg gut abgeschnitten hat.

Moment, wenn: Ihre Workload produktionskritisch ist und keine Regression verkraften kann, während die Branche ihre Erwartungen kalibriert, Sie offene Gewichte für Selbsthosting oder Fine-Tuning benötigen — Solar Pro 4 ist nicht dieses Modell; Solar Open 2 ist es — oder Sie sich auf die 524K-Kontextzahl verlassen, die die erste unabhängige Messung nicht reproduziert.

Es gibt einen Mittelweg, der einen Namen verdient: Setzen Sie Solar Pro 4 hinter eine Failover-Ebene, anstatt eine ganze Pipeline auf dieses Modell zu setzen. Ein Routing-Gateway, das bei Timeout oder Fehler auf ein zweites Modell zurückfallen kann, ermöglicht es Ihnen, die Vorteile eines günstigen neuen Modells zu nutzen, ohne das Risiko eines Single Point of Failure — genau das Muster, für das OrcaRouters automatisches Failover gedacht ist. Und da OrcaRouter die Listenpreise der Anbieter ohne Aufschlag durchreicht, zahlen Sie genau das, was Upstage verlangt, ohne Wiederverkäufer-Marge obendrauf.

Was als Nächstes ansehen

Das Kapitel „noch keine unabhängigen Zahlen“ dieses Modells ist abgeschlossen – es dauerte vier Tage. Worauf es jetzt ankommt, ist, was die erste Messung bedeutet. Der Preis nach der Promo-Aktion: Das 90-Prozent-Abzeichen ist ein Eröffnungsgebot, keine Verpflichtung, und der Listenpreis dahinter beträgt $0.30 / $1.20. Ob Upstage auf die gemessene Latenz und die Diskrepanz zwischen 384K- und 524K-Kontext reagiert – beides die umsetzbarsten Erkenntnisse aus dem AA-Lauf. Und reale Agenten-Workloads – der beste Test für ein Tool-Calling-Modell sind langlaufende Jobs in der Praxis, nicht ein Leaderboard. Stand 13. August 2026 ist die treffende Zusammenfassung von Solar Pro 4 enger und stärker als vor einer Woche: ein sehr günstiges, auf Agenten zugeschnittenes Flaggschiff von einem seriösen Labor, bestätigt als Upstages Nachfolger des Solar Pro 3, mit einem unabhängigen Score von 42, über den man streiten kann.

© 2026 OrcaRouter

Für Anbieter

Du betreibst eine Inferenz-Plattform? Bring deine Modelle auf OrcaRouter.

providers@orcarouter.ai

Community beitreten

Discordsupport@orcarouter.aiXGitHubYouTube