
Runway Solaris: het interface-wereldmodel dat code vervangt door video
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-10$0.15 / $0.60 per 1 mln tokens
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0240Intelligentie72Coderen
- anthropicNIEUWAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligentie69Coderen
Runway Solaris en GWM Worlds 2 zijn de twee modellen die Runway rond het begin van september 2026 uitbracht, en samen zetten ze in op één specifieke gok: dat het volgende nuttige dat een videomodel doet, niet is het renderen van een clip die je bekijkt, maar het vasthouden van een wereld waarin je handelt. Solaris, aangekondigd op 31 augustus, genereert software-interfaces frame voor frame — een klik of een sleepbeweging conditioneert het volgende frame, en het beeld is de applicatie, zonder HTML, CSS, JavaScript of DOM eronder. GWM Worlds 2, aangekondigd op 3 september, past dezelfde truc toe op omgevingen: doorlopende 720p met 24 frames per seconde en 48 kHz-audio, in sessies die niet hoeven te eindigen. Op 10 september publiceerde Runway het onderzoek achter beide, en dat bericht is nuttiger dan de berichtgeving rond de lancering, omdat het uitlegt hoe een diffusievideomodel snel genoeg wordt om live aan te voelen. Wat het niet uitlegt, is hoe je toegang krijgt. Geen van beide modellen heeft een publieke API, een gepubliceerde prijs of downloadbare gewichten.
Waar Solaris en GWM Worlds 2 zich bevinden in de line-up van Runway
Beide modellen stammen van dezelfde plek af. Runway's Gen-4.5-videomodel is het basisartefact; het in december 2025 aangekondigde GWM-1-programma voor algemene wereldmodellen leverde de "wereldmodel"-kadering; Runway Characters, eerder in 2026, was de eerste publieke uiting van het idee dat je een videomodel een prompt kon geven en iets terugkreeg dat reageerde in plaats van iets dat werd afgespeeld.
Solaris voert die afstamming naar iets nauwers en vreemders. Runway noemt het het eerste interface-wereldmodel, en de bewering is niet dat het een afbeelding van een UI genereert, maar dat de generatie is de UI. Een taalmodel bepaalt wat er moet veranderen wanneer je ermee interacteert; het wereldmodel rendert het gevolg. In Runways aankondigingsbericht wordt conventionele app-ontwikkeling neergezet als "lossy compression" — de bedoeling van een ontwerper samengeperst tot code, en vervolgens uitgepakt door een browser, waarbij alles wat je kunt doen beperkt blijft tot wat een ontwikkelaar vooraf heeft geprogrammeerd.
GWM Worlds 2 is de bredere broer. Het genereert interactieve omgevingen in plaats van interfaces, en het bedieningsoppervlak is een formaat dat Runway WorldPrompt noemt: een persistente "genesis"-prompt die omgeving, lay-out, materialen, belichting, sfeer, subjecten, fysieke regels en cameraperspectief vastlegt, plus een eerste frame om de look te verankeren; dan een tijdgestempelde gebeurtenissenstroom van vrijvormige tekstacties gericht aan een subject of de scène, met begin- en eindtijden zodat acties kunnen overlappen.
• Solaris — interface-wereldmodel, gebouwd op Gen-4.5, de eerste in de Interface World Models-serie van Runway, aangekondigd op 31 augustus 2026
• GWM Worlds 2 — tweede algemeen wereldmodel, 720p bij 24 fps, 48 kHz audio inclusief gegenereerde spraak met gesynchroniseerde lipbeweging, aangekondigd op 3 september 2026
• Sessies — zonder vaste lengte voor GWM Worlds 2 in plaats van clips met een vaste lengte; 720p-sessies voor Solaris
• Toegang — Solaris: aanvraagformulier voor vroegtijdige toegang. GWM Worlds 2: contactformulier. Geen van beide heeft prijzen of een openbaar endpoint gepubliceerd
• Opgegeven latentie — Solaris wordt beschreven als draaiend op interactieve snelheden, onder 500 ms per frame
• Onafhankelijke benchmarks — geen. Alles wat tot nu toe is gepubliceerd, is afkomstig van Runway

De drietrapsconversie die de halve seconde oplevert
De onderzoekspost van 10 september, "Towards Instant Video Generation", is de eerste keer dat Runway de machinerie in enig detail beschrijft, en de vorm ervan is bekend uit de diffusie-distillatieliteratuur, ook al is de toepassing dat niet. Het uitgangspunt is een standaard bidirectioneel videomodel — Gen-4.5 — waarbij elke generatiestap conditioneert op een initieel eerste frame en een caption, en eerder gegenereerde latents in context worden gehouden. Dat model is nauwkeurig en traag: flow matching wil veel denoisingstappen per frame, en een frame waarop je moet wachten is geen interface.
De conversie gebeurt in drie stappen. Ten eerste wordt de architectuur omgezet in een temporeel causale, frame-voor-frame autoregressieve generator — elk frame hangt alleen af van wat eraan voorafging, en dat is wat streaming überhaupt mogelijk maakt. Ten tweede brengt distributiematching-distillatie de vele denoisingsstappen terug tot een paar, en daar komt de snelheid vandaan. Dit verloopt in twee fasen, en Runway is ongewoon duidelijk over waarom beide nodig zijn. De off-policy-fase laat de student de volgende toestanden voorspellen vanuit ground-truth-context, terwijl een bevroren bidirectionele teacher goede generaties demonstreert en een critic de student richting de distributie van de teacher duwt — goedkoop, omdat er geen rollouts zijn, maar op zichzelf onvoldoende, aangezien in video een vroege fout de context voor het volgende frame wordt en het model snel buiten de distributie duwt. De on-policy-fase voert daarom rollouts uit tijdens de training, zodat elke gegenereerde latent de context voor de volgende wordt, precies zoals bij inferentie. Runway zegt dat de meeste echte winst uit deze fase komt, en dat een curriculum van toenemende sequentielengte beter is dan vanaf het begin op lange sequenties te trainen.
Ten derde wordt het model getraind op zijn eigen outputs om visuele drift tijdens een lange sessie te voorkomen. De drie fasen samen zijn wat Runway in staat stelt het woord ‘interactief’ te gebruiken; aan geen van de drie is een latentiecijfer, framesnelheid of doorvoercijfer gekoppeld. ‘Goede latentie’ is het meest specifieke dat het bericht biedt. Wat er wel staat, is dat de bottleneck verschuift van training naar inferentie, omdat elk frame het model snel genoeg moet verlaten om op gedeelde hardware te kunnen worden afgespeeld — en die kosten per output bij een gegeven kwaliteit bepalen welke use cases überhaupt levensvatbaar zijn.

De 61-tegen-24-studie, aandachtig lezen
Het cijfer dat het verst reikte sinds de Solaris-aankondiging was een voorkeursscore, dus het loont om precies te zijn over wat er werd gemeten. Runway voerde een onderzoek uit met 250 deelnemers en ongeveer 7.500 paarsgewijze beoordelingen over 30 interactievoorbeelden. Deelnemers verkozen Solaris 61 procent van de tijd boven een gecodeerde interface gegenereerd door Claude Opus 5 als het ging om het volgen van interactie-instructies, tegenover 24 procent voor de gecodeerde versie; op natuurlijkheid van gedrag was de verhouding 71 tegen 21.
Drie dingen die dat getal niet is. Het is geen onafhankelijk resultaat — Runway heeft het ontworpen, uitgevoerd en gerapporteerd, en geen enkele derde partij heeft het gereproduceerd. Het is geen maatstaf voor of de interface werkte: instructieopvolging en natuurlijkheid van gedrag zijn oordelen over hoe het eruitzag en aanvoelde, niet of een taak correct werd voltooid. En het is geen vergelijking met Claude Opus 5 zelf, dat een taalmodel is; het is een vergelijking met interfaces die een taalmodel als code heeft geschreven. Dat onderscheid is de hele weddenschap in één zin — de bewering is niet dat Solaris slimmer is dan een LLM, maar dat het overslaan van de codelaag een natuurlijker resultaat oplevert.
Wat het model nog steeds niet kan
Runway is openhartiger over de hiaten dan lanceringsberichten gewoonlijk zijn, en de hiaten zijn structureel in plaats van cosmetisch.
• Tekstweergave — leesbare, stabiele tekst is echt moeilijk voor een model dat is gebouwd op videogeneratietechnologie, en interfaces bestaan uit tekst. Runway heeft een hybride geopperd: laat een conventioneel beeldmodel tekstrijke weergaven renderen tijdens pauzes in de interactie
• Toegankelijkheid — een gegenereerde interface heeft geen DOM, dus schermlezers en toegankelijkheids-API's hebben niets om aan te koppelen. Dit is geen bug om te melden; het is een eigenschap van de aanpak
• Lange sessies — coherentie neemt af bij langdurige open-eindige interactie, wat precies het regime is waarin een interface leeft
• Vertrouwen en verankering — een zelfverzekerde, onjuiste weergave is erger dan geen weergave, en Solaris is ervan afhankelijk dat zijn startframe verankerd is in geverifieerd referentiemateriaal
• Resolutie — 720p is ruim voor een videoclip en krap voor datadichte desktopsoftware
Voor GWM Worlds 2 zijn de erkende beperkingen een andere set: snelle camerarotaties tasten detail, textuur en geometrie aan; het langetermijngeheugen is onvolledig, dus een kamer die je verlaat en weer betreedt, bevat mogelijk niet dezelfde objecten; afbeeldingsreferenties stoppen bij het eerste frame of een vooraf gevulde clip; en stateful dialogen hebben meestal een extern harnas nodig om iets bij te houden.
Waarom Runway denkt dat dit infrastructuur voor agenttraining is
Het interessantste argument rond Solaris gaat helemaal niet over interfaces. Omdat het een interface kan genereren die nog nooit heeft bestaan — in plaats van een bekende lay-out op te halen — zou het kunnen worden gebruikt om agenten te trainen die computers gebruiken en moeten generaliseren in plaats van memoriseren. Dat richt zich op een echte zwakte: agenten die zijn getraind op een handvol bekende app-lay-outs zijn vaak kwetsbaar zodra de lay-out verandert. GWM Worlds 2 houdt hetzelfde pleidooi voor belichaamd werk, en levert een expliciete agent-controlmodus waarin een AI-agent taken plant en uitvoert binnen de wereld.

Het is een goed argument en een onvolledig argument. Een omgeving die niet betrouwbaar kan onthouden dat de lamp die hij heeft ingeschakeld nog aan is, is een slechte plek om iets te trainen dat van toestand afhankelijk is — en dat is het grootste deel van wat agents doen. Runway zegt dat ook in zijn eigen sectie over beperkingen. De eerlijke lezing is dat dit een veelbelovende richting is, met een probleem met het bijhouden van toestand dat er direct in de weg zit.
Wat je vandaag daadwerkelijk kunt bellen
Solaris is een onderzoekspreview. Toegang verloopt via een aanvraagformulier voor vroegtijdige toegang, gericht op partners, en Runway heeft geen openbare lanceringsdatum aangekondigd. Er is geen Solaris-endpoint in de eigen API-referentie van Runway, geen prijsstelling en geen vrijgegeven gewichten. GWM Worlds 2 is alleen toegankelijk via een contactformulier, terwijl Runway het valideert met geselecteerde partners. Als je wacht om op een van beide te bouwen, dan wacht je.
Dat is belangrijk voor hoe je de rest van de berichtgeving leest, want een groot deel ervan beschrijft Solaris in de tegenwoordige tijd van een product dat al is uitgebracht. Dat is het nog niet, en Runway beweert dat ook niet.
Niets hiervan is iets wat OrcaRouter voor je kan aanroepen. Onze catalogus bestaat uit tekst- en multimodale modellen — 195 daarvan op het moment van schrijven, en niets dat de vorm van een wereldmodel heeft. Wat wij wél routeren is de andere helft van de stack. Als de interessante toekomst hier een agent is die een gegenereerde interface aanstuurt, moet er nog steeds een model zijn dat bepaalt wat er moet gebeuren, en die kant is vandaag beschikbaar: één sleutel voor een catalogus van meer dan 200 modellen, met 0% opslag op de lijstprijs van de provider, automatische failover wanneer een provider achteruitgaat, een routing-DSL om meerdere modellen in één aanroep samen te brengen, en modelfusie wanneer je wilt dat een panel samen antwoordt in plaats van één model. Je kunt een nieuw model op een productiepad uitproberen zonder dat pad eraan te wagen.
Wat te kijken
De vraag die beslist of Solaris een product wordt, is niet of gegenereerde interfaces indrukwekkend lijken — dat doen ze aantoonbaar — maar of Runway een latentiecijfer kan publiceren en dat kan waarmaken. Alles wat daarop volgt, hangt daarvan af: het verhaal over agenttraining, het argument van kosten per output, en de bewering dat video is waar interfaces naartoe gaan.
Drie signalen zijn het volgen waard. Een getal, welk getal dan ook, gekoppeld aan de bewering van minder dan 500 ms. Een tweede, onafhankelijke reproductie van de preferentiestudie. En een endpoint — want totdat Solaris in Runway's API-referentie verschijnt met een prijs ernaast, is de juiste manier om ermee om te gaan die van een onderzoeksrichting met een ongewoon goede demo reel, wat een echte rol is om te vervullen en tegelijkertijd nog geen tool.
