
Solar Pro 4 behaalt 42: Upstage's agent-first vlaggenschip, nu onafhankelijk gemeten
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenNIEUWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNIEUWDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokNIEUWSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligentie77Coderen
Upstage Solar Pro 4 werd gelanceerd op 10 augustus 2026, en het eerste getal dat het bekijken waard was, was de prijs: $0,30 per miljoen invoertokens en $1,20 per miljoen uitvoertokens op de eigen API van Upstage, met een lanceerpromotie die dat verlaagt naar $0,03 en $0,12 — 90% korting — op de huidige aanbiedingen. Vier dagen later kwam het tweede getal dat het bekijken waard was. Op 12 augustus 2026 publiceerde Artificial Analysis de eerste onafhankelijke evaluatie van Solar Pro 4 en beoordeelde het met 42 op zijn Intelligence Index, tegen 14 voor Solar Pro 3 — een verdrievoudiging van de gemeten score van de voorganger en een sprong van 27 punten volgens de eigen rekenmethode van het lab — waarmee Upstage's positionering van Solar Pro 4 als zijn eigen vlaggenschip wordt bevestigd, het model dat Solar Pro 3 aan de top van de lijn vervangt. Hoe dan ook, goedkoop; nu ook onafhankelijk gemeten.
Wat er daadwerkelijk is uitgebracht
Solar Pro 4 is het commerciële vlaggenschip van Upstage's omslag naar het agent-tijdperk. Het bedrijf heeft 2026 besteed aan het herbouwen van de Solar-lijn rond agentische workloads — het open-weight zustermodel Solar Open 2 werd eind juli uitgebracht — en Solar Pro 4 is het gehoste product waar die omslag op gericht was. Upstage vat het in één zin samen: een model voor taken die aanhoudende context, uitvoering in meerdere stappen en end-to-end afronding vereisen, in plaats van eenmalige antwoorden.
Concreet beschrijft de modelpagina het als Upstage's vlaggenschipmodel, gespecialiseerd in agentisch gebruik, geschikt voor agentische workflows, kantoorefficiëntie, documentintensief werk en coderen. Op papier is het het grootste contextvenster dat de lijn heeft uitgebracht — Solar Pro 3 bood 128K — en de enige Solar tot nu toe met een gepubliceerd redeneerverhaal en een tool-calling-interface gericht op autonome agenten.
Specificaties zoals vermeld bij de lancering:
• Contextvenster — 524.288 tokens (524K) op de productpagina van de leverancier, ruwweg vier keer de 128K van de vorige generatie; de onafhankelijke meting van Artificial Analysis registreert 384K, dus behandel het grotere getal als de claim van Upstage.
• Prijs — officiële Upstage API-prijs: $0,30 per 1M invoertokens / $1,20 per 1M uitvoertokens, met gecachte invoer voor $0,06; een lanceringspromotie biedt 90% korting op de huidige vermeldingen, namelijk $0,03 / $0,12.
• Mogelijkheden — redeneren, function calling, JSON-modus, streaming en webzoekopdrachten, met ondersteuning voor beeldinvoer.
• Gewichten — propriëtair, niet open; geen Hugging Face-release (in tegenstelling tot de open Solar Open 2)
• Toegang — Upstage Console API plus verschillende platforms van derden; een chat-app op solar-chat.upstage.ai voor hands-on testen
Die cijfers zijn de opgave van de leverancier, geen gecontroleerd specificatieblad — en de eerste onafhankelijke meting spreekt nu een daarvan tegen. Artificial Analysis registreert voor Solar Pro 4 een contextvenster van 384K tokens en een maximale output van 256K, tegenover de 524K en 128K–131K die de leverancier vermeldt. De lijst met mogelijkheden en Upstage's eigen contextcijfer komen van de modelpagina; de AA-cijfers zijn de onafhankelijke meting.


Wat is er veranderd ten opzichte van Solar Pro 3 — de eerste onafhankelijke cijfers
Upstage's eigen claims voor Solar Pro 4 richten zich op drie verbeterpunten ten opzichte van Solar Pro 3, die allemaal relevant zijn voor agents: redeneren over lange documenten, toolgebruik over meerdere beurten, en prestaties bij terminaltaken. Dat zijn precies de dimensies waarin een agentmodel zijn waarde bewijst — een rode draad vasthouden door een lang document, een reeks toolcalls volhouden zonder de draad kwijt te raken, en taken afronden die in een shell draaien.
De eerste onafhankelijke test bevestigt de richting van al die beweringen. Artificial Analysis gaf Solar Pro 4 een score van 42 op zijn Intelligence Index, tegenover 14 voor Solar Pro 3, en de grootste verbeteringen zitten precies waar Upstage op wees:
• Terminal-Bench v2.1 (terminaltaken): 12% → 57%
• AA-LCR (redeneren over lange contexten): 31% → 71%
• τ³-Banking (multi-turn toolgebruik): 9% → 23%
• GDPval-AA v2 (agentisch werk in de echte wereld): Elo 498 → 1,277, boven de menselijke basislijn van 1,000 en iets voor op Qwen3.7 Max (1,272) en MiMo-V2.5-Pro (1,266).
De indexplaatsing is het hoofdnieuws: 42 staat naast Inkling (xhigh, 42) en net achter MiMo-V2.5-Pro (43). Een model geprijsd als een budgetklasse meet nu als een serieuze agent.
Er waren twee kanttekeningen bij de score. De AA-Omniscience-verbetering (-53 → -1) is grotendeels onthouding: Solar Pro 4 beantwoordt slechts 41% van de vragen tegenover 92% voor Solar Pro 3; het hallucinatiepercentage daalde van 88% naar 24%, maar de nauwkeurigheid bleef stabiel op 19%. En de intelligentiewinst ging ten koste van latentie — ongeveer 8,6 minuten per Intelligence Index-taak tegenover 6,0 voor Solar Pro 3, terwijl het tokenverbruik verbeterde van ruwweg 52k naar 43k outputtokens per taak. Het is een slimmer, voorzichtiger, langzamer model.
Waarom de prijs belangrijker is dan de specificaties
Het argument voor Solar Pro 4 is de verhouding tussen prijs en gemeten intelligentie. Zelfs tegen de officiële catalogusprijs onderbiedt een model met een context van 384K–524K voor $0,30 per miljoen invoertokens vrijwel het gehele veld — ruwweg een zestiende van de invoerprijs van een toonaangevend vlaggenschip — en met de 90%-kortingsactie wordt dat een zestiende van een zestiende. Dat belandt in een segment waar de markt momenteel kleine snelle modellen verkoopt, niet agent-capabele modellen met een geverifieerde middenklasse-score.

De sceptische houding is niet langer dat Solar Pro 4 onbewezen is — de AA-run beslecht dat — maar dat het echt is. De alwetendheidswinst is deels een weigeringspatroon, niet alleen kennis. De gemeten latentie is een stap terug ten opzichte van Solar Pro 3. De 384K-context van Artificial Analysis ligt onder de 524K-koptekst van de leverancier. En de badge '90% korting' betekent dat de toekomstige prijs kan wijzigen zodra de promotieperiode eindigt — het duurzame tarief is de lijstprijs van $0,30 / $1,20, niet de stickerprijs van $0,03 / $0,12.
Wie moet het proberen, wie moet wachten
Probeer het nu als: je een agent-prototype bouwt en de dominante kosten tokens zijn, je een lang contextvenster nodig hebt en je workload langzamer denken tolereert, of je Koreaanse en Oost-Aziatische documentworkloads evalueert, waar Upstage consequent goed op heeft getraind.
Wacht even: als uw workload productiekritiek is en geen regressie kan opvangen terwijl het veld de verwachtingen bijstelt, heeft u open weights nodig voor self-hosting of fine-tuning — Solar Pro 4 is niet dat model; Solar Open 2 is het — of u koopt op basis van het 524K-contextnummer, dat de eerste onafhankelijke meting niet reproduceert.
Er is een middenweg die het benoemen waard is: plaats Solar Pro 4 achter een failoverlaag in plaats van een hele pijplijn erop te verwedden. Een routeringsgateway die bij een time-out of fout kan terugvallen op een tweede model, laat je profiteren van de voordelen van een goedkoop nieuw model zonder het risico van een single point of failure — het patroon waarvoor de automatische failover van OrcaRouter bestaat, en omdat OrcaRouter de lijstprijzen van providers zonder opslag doorgeeft, betaal je precies wat Upstage in rekening brengt, zonder wederverkoopmarge erbovenop.
Wat nu te kijken
Het hoofdstuk 'nog geen onafhankelijke cijfers' van dit model is gesloten — het duurde vier dagen. Wat er nu toe doet, is wat de eerste meting impliceert. De prijs na de promotie: de 90%-badge is een openingsbod, geen toezegging, en de lijstprijs erachter is $0.30 / $1.20. Of Upstage reageert op de gemeten latentie en de contextdiscrepantie van 384K versus 524K, beide de meest bruikbare bevindingen uit de AA-run. En echte agent-workloads — de beste test voor een tool-calling-model is langlopende jobs in de praktijk, niet een leaderboard. Per 13 augustus 2026 is de nauwkeurige samenvatting van Solar Pro 4 smaller en sterker dan een week geleden: een zeer goedkoop, agentvormig vlaggenschip van een serieus lab, bevestigd als Upstages vervanger van Solar Pro 3, met een onafhankelijke score van 42 om over te twisten.
