
Solar Pro 4 erzielt 42: Upstages Agent-First-Flaggschiff, jetzt unabhängig gemessen
- DeepSeekNEUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianNEUQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenNEUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokNEUSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenz77Coding
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenz77Coding
Upstage Solar Pro 4 ging am 10. August 2026 live, und die erste Zahl, die man sich ansehen sollte, war der Preis: 0,30 $ pro Million Input-Tokens und 1,20 $ pro Million Output-Tokens in Upstages eigener API, mit einem Einführungsangebot, das das auf 0,03 $ und 0,12 $ senkt – 90 % Rabatt – in den aktuellen Angeboten. Vier Tage später kam die zweite Zahl, die man sich ansehen sollte. Am 12. August 2026 veröffentlichte Artificial Analysis die erste unabhängige Bewertung von Solar Pro 4 und bewertete es mit 42 auf seinem Intelligence Index, gegenüber 14 für Solar Pro 3 – eine Verdreifachung des gemessenen Ergebnisses im Vergleich zum Vorgänger und ein Sprung um 27 Punkte nach der eigenen Arithmetik des Labors – was Upstages Positionierung von Solar Pro 4 als proprietäres Flaggschiff bestätigt, das Modell, das Solar Pro 3 an der Spitze der Produktlinie ersetzt. Wie auch immer, günstig; jetzt auch unabhängig gemessen.
Was tatsächlich ausgeliefert wurde
{{1}}Solar Pro 4 ist das kommerzielle Flaggschiff von Upstages Wende zur Agenten-Ära.{{/1}} {{2}}Das Unternehmen hat 2026 damit verbracht, die Solar-Produktlinie rund um agentische Workloads neu aufzubauen — sein Open-Weight-Pendant Solar Open 2 erschien Ende Juli — und Solar Pro 4 ist das gehostete Produkt, auf das diese Wende abzielte.{{/2}} {{3}}Upstage fasst es in einem Satz zusammen: ein Modell für Aufgaben, die anhaltenden Kontext, mehrstufige Ausführung und einen Ende-zu-Ende-Abschluss erfordern, statt einmaliger Antworten.{{/3}}
Konkret beschreibt die Modellseite es als Upstages Flaggschiff-Modell, das speziell für agentischen Einsatz entwickelt wurde und sich für agentische Workflows, Büroproduktivität, dokumentintensive Arbeit und Programmierung eignet. Auf dem Papier ist es der größte Kontext, den die Reihe je ausgeliefert hat – Solar Pro 3 bot 128K – und das bisher einzige Solar-Modell mit einer veröffentlichten Reasoning-Geschichte und einer Tool-Calling-Oberfläche, die auf autonome Agenten ausgerichtet ist.
Technische Daten wie zum Start aufgeführt:
• Kontextfenster — 524.288 Tokens (524K) in der Auflistung des Anbieters, etwa das Vierfache der 128K der vorherigen Generation; die unabhängige Messung von Artificial Analysis verzeichnet 384K, daher ist die größere Zahl als Upstages Angabe zu betrachten.
• Preis — offizieller Upstage-API-Tarif: 0,30 $ pro 1M Eingabe-Tokens / 1,20 $ pro 1M Ausgabe-Tokens, mit gecachtem Input bei 0,06 $; ein Einführungsangebot bietet es mit 90 % Rabatt für 0,03 $ / 0,12 $ in den aktuellen Angeboten.
• Fähigkeiten — logisches Denken, Funktionsaufrufe, JSON-Modus, Streaming und Websuche, mit Unterstützung für Bildeingabe
• Weights — proprietär, nicht offen; keine Veröffentlichung auf Hugging Face (im Gegensatz zum offenen Solar Open 2)
• Zugriff — Upstage Console API sowie mehrere Drittanbieter-Plattformen; eine Chat-App unter solar-chat.upstage.ai für praktische Tests
Diese Zahlen stammen aus der Auflistung des Anbieters, nicht aus einem geprüften Datenblatt – und die erste unabhängige Messung widerspricht nun einer davon. Artificial Analysis verzeichnet für Solar Pro 4 ein Kontextfenster von 384K Token und eine maximale Ausgabe von 256K, gegenüber den 524K und 128K–131K, die der Anbieter angibt. Die Liste der Fähigkeiten und Upstages eigene Kontextangabe stammen von der Modellseite; die AA-Zahlen sind die unabhängige Messung.


Was hat sich gegenüber Solar Pro 3 geändert — die ersten unabhängigen Zahlen.
Upstages eigene Behauptungen für Solar Pro 4 konzentrieren sich auf drei Verbesserungsbereiche gegenüber Solar Pro 3, die alle für Agenten relevant sind: Reasoning über lange Dokumente, mehrstufige Tool-Nutzung und Leistung bei Terminal-Aufgaben. Genau das sind die Dimensionen, in denen ein Agentenmodell seinen Wert beweist – einen Faden über ein langes Dokument hinweg aufrechtzuerhalten, eine Sequenz von Tool-Aufrufen durchzuhalten, ohne den Überblick zu verlieren, und Aufgaben abzuschließen, die in einer Shell laufen.
Der erste unabhängige Lauf stützt die Richtung all dieser Behauptungen. Artificial Analysis bewertete Solar Pro 4 mit 42 auf seinem Intelligence Index, gegenüber 14 für Solar Pro 3, und die größten Zugewinne liegen genau dort, worauf Upstage hingewiesen hat:
• Terminal-Bench v2.1 (Terminal-Aufgaben): 12% → 57%
• AA-LCR (Long-Context-Reasoning): 31 % → 71 %
• τ³-Banking (mehrschrittige Tool-Nutzung): 9% → 23%
• GDPval-AA v2 (reale agentische Arbeit): Elo 498 → 1,277, über der menschlichen Basislinie von 1,000 und leicht vor Qwen3.7 Max (1,272) und MiMo-V2.5-Pro (1,266)
{{1}}Die Indexplatzierung ist die Schlagzeile: 42 steht neben Inkling (xhigh, 42) und knapp hinter MiMo-V2.5-Pro (43).{{/1}} {{2}}Ein Modell, das wie eine Budget-Klasse bepreist ist, misst sich nun wie ein ernstzunehmender Agent.{{/2}}
Zwei Einschränkungen gingen mit dem Ergebnis einher. Die Verbesserung bei AA-Omniscience (-53 → -1) ist größtenteils auf Enthaltung zurückzuführen: Solar Pro 4 versucht nur 41 % der Fragen zu beantworten, gegenüber 92 % bei Solar Pro 3. Die Halluzinationsrate sank von 88 % auf 24 %, aber die Genauigkeit blieb unverändert bei 19 %. Und der Intelligenzzuwachs kostete Latenz – etwa 8,6 Minuten pro Intelligence-Index-Aufgabe gegenüber 6,0 Minuten bei Solar Pro 3, während sich der Token-Verbrauch von etwa 52.000 auf 43.000 Ausgabe-Token pro Aufgabe verbesserte. Es ist ein klügeres, vorsichtigeres, langsameres Modell.
Warum der Preis wichtiger ist als die Specs
Das Argument für Solar Pro 4 ist sein Verhältnis von Preis zu gemessener Intelligenz. Selbst zum offiziellen Listenpreis unterbietet ein Modell mit 384K–524K-Kontext für 0,30 $ pro Million Input-Tokens praktisch das gesamte Feld – etwa ein Sechzehntel des Input-Preises eines Top-Flaggschiffs – und die Aktion mit 90 % Rabatt senkt das auf ein Sechzehntel von einem Sechzehntel. Das landet in einem Bereich, in dem der Markt derzeit kleine schnelle Modelle verkauft, keine agentenfähigen mit einem verifizierten mittleren Score.

Die skeptische Position ist nicht mehr, dass Solar Pro 4 unbewiesen ist — der AA-Lauf klärt das — sondern dass es echt ist. Der Zuwachs an Allwissenheit ist teilweise ein Verweigerungsmuster, nicht nur Wissen. Die gemessene Latenz ist ein Rückschritt gegenüber Solar Pro 3. Der 384K-Kontext von Artificial Analysis liegt unter den vom Anbieter beworbenen 524K. Und das „90 % off“-Abzeichen bedeutet, dass sich der künftige Preis nach Ablauf des Aktionszeitraums ändern kann — der dauerhafte Preis ist der Listenpreis von 0,30 $ / 1,20 $, nicht das Preisschild von 0,03 $ / 0,12 $.
Wer es ausprobieren sollte, wer warten sollte
Probieren Sie es jetzt aus, wenn: Sie einen Agenten prototypen und Token die dominierenden Kosten sind, Sie ein langes Kontextfenster benötigen und Ihre Arbeitslast langsameres Denken toleriert, oder Sie koreanischsprachige und ostasiatische Dokument-Workloads auswerten, bei denen Upstage durchweg gut abgeschnitten hat.
Moment, wenn: Ihre Workload produktionskritisch ist und keine Regression verkraften kann, während die Branche ihre Erwartungen kalibriert, Sie offene Gewichte für Selbsthosting oder Fine-Tuning benötigen — Solar Pro 4 ist nicht dieses Modell; Solar Open 2 ist es — oder Sie sich auf die 524K-Kontextzahl verlassen, die die erste unabhängige Messung nicht reproduziert.
Es gibt einen Mittelweg, der einen Namen verdient: Setzen Sie Solar Pro 4 hinter eine Failover-Ebene, anstatt eine ganze Pipeline auf dieses Modell zu setzen. Ein Routing-Gateway, das bei Timeout oder Fehler auf ein zweites Modell zurückfallen kann, ermöglicht es Ihnen, die Vorteile eines günstigen neuen Modells zu nutzen, ohne das Risiko eines Single Point of Failure — genau das Muster, für das OrcaRouters automatisches Failover gedacht ist. Und da OrcaRouter die Listenpreise der Anbieter ohne Aufschlag durchreicht, zahlen Sie genau das, was Upstage verlangt, ohne Wiederverkäufer-Marge obendrauf.
Was als Nächstes ansehen
Das Kapitel „noch keine unabhängigen Zahlen“ dieses Modells ist abgeschlossen – es dauerte vier Tage. Worauf es jetzt ankommt, ist, was die erste Messung bedeutet. Der Preis nach der Promo-Aktion: Das 90-Prozent-Abzeichen ist ein Eröffnungsgebot, keine Verpflichtung, und der Listenpreis dahinter beträgt $0.30 / $1.20. Ob Upstage auf die gemessene Latenz und die Diskrepanz zwischen 384K- und 524K-Kontext reagiert – beides die umsetzbarsten Erkenntnisse aus dem AA-Lauf. Und reale Agenten-Workloads – der beste Test für ein Tool-Calling-Modell sind langlaufende Jobs in der Praxis, nicht ein Leaderboard. Stand 13. August 2026 ist die treffende Zusammenfassung von Solar Pro 4 enger und stärker als vor einer Woche: ein sehr günstiges, auf Agenten zugeschnittenes Flaggschiff von einem seriösen Labor, bestätigt als Upstages Nachfolger des Solar Pro 3, mit einem unabhängigen Score von 42, über den man streiten kann.
