SSI's eerste model: wat we daadwerkelijk kunnen verifiëren over de claim van augustus 2026
Guides & Insights

SSI's eerste model: wat we daadwerkelijk kunnen verifiëren over de claim van augustus 2026

Auteur

Jim Song

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

SSI zegt dat ze in augustus met hun model komen. Elf woorden, terloops uitgesproken door een hedgefondsbelegger in een podcast die vooral over GPU-vraag ging, vormen de volledige basis voor elke kop die beweert dat Ilya Sutskever's Safe Superintelligence op het punt staat zijn eerste model uit te brengen. Er is geen aankondiging, geen modelcard, geen naam, geen benchmark, geen prijs en geen endpoint. Het is de moeite waard om daar even bij stil te staan, want het is het tegenovergestelde van hoe een normale frontier-lancering plaatsvindt: toen GPT-5.6 Sol of Claude Opus 5 verscheen, was er een system card, een prijs per miljoen tokens en een API die je dezelfde middag nog kon aanroepen. Hier is er slechts een passage in een transcript.

Dus dit stuk is geen lanceerartikel. Het is een bewijscontrole: wat er in het dossier staat, wie het zei, wat SSI's eigen kanalen tonen per 5 augustus 2026, en welke delen van het verhaal gevolgtrekkingen zijn in plaats van feiten. Alles wat niet geverifieerd is, wordt als niet geverifieerd bestempeld, inclusief de delen waarvan we denken dat ze waarschijnlijk kloppen.

Waar de claim eigenlijk vandaan komt

De bron is Gavin Baker, medeoprichter en CIO van Atreides Management, die spreekt in een aflevering van Patrick O'Shaughnessy's Invest Like the Best die in de eerste dagen van augustus 2026 is verschenen. Baker had geen nieuws over SSI te melden. Hij voerde een betoog over halfgeleiders: dat als continu, sample-efficiënt leren wordt opgelost — een model traint op ruwweg tien biljoen tokens en blijft daarna in de wereld leren zonder volledige hertraining — de economie van de chipvraag omkeert, waarbij trainingsuitgaven ineenstorten tot marginale niveaus en inferentie plus continue updates de overhand krijgen. De SSI-opmerking was een ondersteunende terzijde in dat betoog.

De keten vanaf daar is kort en de moeite waard om uit te schrijven, omdat die verklaart waarom het verhaal groter aanvoelt dan zijn bewijs:

• De primaire bewering — één getranscribeerde zin van Baker, toegeschreven aan SSI ("SSI zegt…") maar zonder genoemde SSI-bron, geen datum in augustus, en geen beschrijving van wat "hun model" is.

• Eerste vermelding — berichtgeving in de vakpers die het correct weergaf als een bewering van Baker, niet als een verklaring van het bedrijf.

• Amplificatie — X-accounts met een grote AI-followersschare die het herplaatsen als "SSI lanceert in augustus zijn eerste LLM," wat een terloopse opmerking uit de tweede hand stilletjes opwaardeert tot een schemaspecificatie, en het woord "LLM" toevoegt, dat Baker niet zei.

• Aggregatie — een golf van lijstjesartikelen en nieuwsbrieven die de X-berichten aanhalen in plaats van het transcript.

Niets in die keten is oneerlijk, maar merk op wat er met de epistemische status gebeurt bij elke stap. Bij stap drie is het een lanceerdatum. Baker is een serieuze, goed geïnformeerde investeerder met echte toegang, en hij is niet het soort persoon dat zo'n detail verzint — behandel het als een geloofwaardig signaal uit de tweede hand. Geloofwaardig uit de tweede hand is echter nog niet bevestigd, en op het moment van schrijven heeft SSI er niets over gezegd, noch heeft een medium een reactie van het bedrijf gerapporteerd.

Wat SSI's eigen kanalen zeggen — en wat niet

Dit is het deel dat bijna geen enkele verslaggeving de moeite nam om te controleren, en het is in ongeveer negentig seconden te controleren. SSI publiceert op precies één plek: een updatespagina op ssi.inc. In de meer dan twee jaar van zijn bestaan bevat die pagina drie berichten.

• 4 september 2024 — de $1B-ronde van NFDG, a16z, Sequoia, DST Global en SV Angel.

• 3 juli 2025 — de leiderschapsnotitie: Daniel Gross is per 29 juni "officieel geen deel meer van SSI", Sutskever is formeel CEO, Daniel Levy president, plus een zin die overnamegeruchten erkent en de afsluiting: "We hebben de rekenkracht, we hebben het team, en we weten wat we moeten doen."

• 26 juli 2026 — één zin: "We zijn een strategisch partnerschap aangegaan met NVIDIA dat ons in staat zal stellen onze rekenkracht met 10x te schalen."

Dat is het volledige openbare dossier. Geen model, geen product, geen onderzoekspaper, geen benchmark, geen wachtlijst. De voorpagina leest nog steeds "SSI is our mission, our name, and our entire product roadmap." De carrièrelink verwijst nog steeds naar één enkele Ashby-plaatsing — Member of Technical Staff — zonder functies voor inferentie, serving, developer relations, trust en safety of wat dan ook dat een lab doorgaans bemand in de weken voordat het een publieke API opent.

Beschouw dat als zwak bewijsmateriaal, niet als bewijs. SSI is een lab van ongeveer vijftig personen, waarvan de typerende eigenschap is dat het de wereld niets vertelt, en een bedrijf dat nooit vooraf aankondigt, zal dit ook niet vooraf aankondigen. Een lab kan ook een onderzoeksartefact uitbrengen zonder enige productorganisatie. Maar als je probeert te beslissen hoeveel gewicht je aan "August" moet toekennen, is het eerlijke antwoord dat SSI's eigen oppervlak nul voorbereiding toont, en het is het enige oppervlak dat we kunnen inspecteren.

Dit zou de 'straight shot'-belofte feitelijk niet verbreken

De dominante framing van dit verhaal is een ommekeer: Sutskever zwoer dat hij niets zou uitbrengen tot superintelligentie, dus een model in augustus is een terugkrabbel, vermoedelijk afgedwongen door concurrentie- of investeerdersdruk. Die framing is onjuist, en het corrigeren ervan is het allernuttigste dat je uit dit artikel kunt meenemen.

Ja, bij de oprichting in juni 2024 was de lijn absoluut: het eerste product zal de veilige superintelligentie zijn, en het bedrijf zal tot die tijd niets anders doen. Maar Sutskever heeft dat standpunt zelf, officieel, meer dan acht maanden geleden herzien. In zijn gesprek met Dwarkesh Patel in november 2025 zei hij dat "zelfs in het scenario van een directe doorbraak, je nog steeds een geleidelijke uitrol ervan zou doen," en woog hij de afweging hardop — dat het "heel fijn is om niet beïnvloed te worden door de dagelijkse marktconcurrentie," maar dat "er veel waarde zit in de beste en krachtigste AI die er is en de wereld beïnvloedt." Eerdere opmerkingen wezen in dezelfde richting: als de tijdlijn naar superintelligentie lang liep, of als hij zou oordelen dat de wereld krachtige AI in actie moest zien, zou een product eerder kunnen komen.

Dus een eerste release in 2026 is consistent met het aangekondigde plan, geen verraad ervan. Dat is belangrijk voor hoe je het gerucht leest: je hebt geen verhaal nodig over SSI die zonder geld zit of die capituleert voor een groter lab om een augustusmodel aannemelijk te maken. Je hebt alleen de clausule voor geleidelijke vrijgave nodig die Sutskever al in zijn eigen strategie had opgeschreven. Het werkt ook de andere kant op — een "geleidelijke release" van een onderzoeksysteem is een veel lagere lat dan een commerciële API, en levert je een veel minder interessant product op dan de koppen doen vermoeden.

De berekeningstijd geeft aan dat een August-model geen Vera Rubin-model is.

Hier is een stukje rekenwerk dat de geruchtenverslaggeving overslaat. Het NVIDIA-partnerschap werd door SSI op 26 juli 2026 gepubliceerd en door NVIDIA op 27 juli 2026. NVIDIA's persbericht beschrijft een investering plus toegang tot zijn volgende-generatie Vera Rubin-platform om de rekenkracht van SSI 'met een orde van grootte' te verhogen; SSI's eigen bewoording is 10x. Het gerapporteerde bedrag van $5 miljard aan eigen vermogen komt via Bloomberg van mensen die over de deal zijn ingelicht — geen van beide bedrijven heeft een bedrag bevestigd, dus behandel het getal als gerapporteerd, niet officieel. Cruciaal is dat de 10x wordt gepresenteerd als plaatsvindend over de twaalf maanden volgend op de aankondiging.

Een model dat in augustus 2026 verschijnt, is daarom getraind voordat dat allemaal beschikbaar kwam. Wat er ook uitkomt, is een product van de eerdere voetafdruk van SSI — de cloud-TPU-capaciteit die het in april 2025 regelde en de GPU-capaciteit die het sindsdien heeft gekocht — niet van het cluster dat het net heeft aangekondigd. Hieruit volgen twee consequenties, en beide zijn onze interpretatie, geen gerapporteerd feit:

• De schaalverwachtingen moeten bescheiden zijn. Dit zou geen lab zijn dat trainingsbudgetten op frontierschaal uitgeeft; het totale opgehaalde kapitaal bedraagt ruwweg $6–7B over alle rondes, inclusief de gerapporteerde NVIDIA-investering, terwijl concurrenten per jaar alleen al aan training het veelvoud daarvan uitgeven.

De volgorde lijkt op een pre-launch kapitaalronde. Strategisch geld aannemen en een uitbreiding van de rekenkracht met een orde van grootte aankondigen, drie tot vijf weken voordat je eerste publieke artefact verschijnt, is een herkenbaar patroon, en het wijst erop dat het model een begin is eerder dan een culminatie.

Sutskever's eigen framing ondersteunt de bescheiden lezing. In dezelfde podcast betoogde hij dat schaal niet het punt is wanneer het idee nieuw is: "als je iets anders doet, heb je dan werkelijk de absolute maximale schaal nodig om het te bewijzen? Ik denk niet dat dat waar is." Zijn NVIDIA-citaat — "We hebben onderzoek dat het opschalen waard is, en toegang tot een grote NVIDIA-computer stelt ons in staat dat te doen" — leest als een lab dat op kleine schaal iets heeft gevonden en nu de rekenkracht koopt om ermee door te gaan. Iets dat in augustus werd uitgebracht, zou bewijs zijn uit de kleinschalige fase.

Wat voor soort model zou SSI eigenlijk leveren?

Niemand buiten het lab weet het. Maar de inputs voor een gok zijn ongewoon publiek, omdat Sutskever het afgelopen jaar precies heeft beschreven wat volgens hem kapot is.

Zijn diagnose, uit het interview van november 2025: de industrie heeft het {{1}}"tijdperk van schaling"{{/1}} (ruwweg 2020–2025) verlaten en is opnieuw een {{2}}"tijdperk van onderzoek,"{{/2}} binnengegaan, en SSI is {{3}}"bij uitstek een 'tijdperk van onderzoek'-bedrijf."{{/3}} De specifieke tekortkoming waar hij steeds op terugkomt, is generalisatie — modellen die er op evaluaties uitstekend uitzien en zich vervolgens fragiel gedragen in de echte wereld, wat hij beschrijft als oprecht verwarrend gezien hoe weinig meetbare economische impact ze hebben gehad. De oplossingen die hij noemt, zijn sample-efficiënt reinforcement learning en robuuste waardefuncties, die hij vergelijkt met de rol die emoties spelen in menselijke oordeelsvorming. Zijn schatting voor het bereiken van systemen die continu leren zoals mensen dat doen, was {{4}}"5 tot 20"{{/4}} jaar.

Zet dat af tegen de context die Baker daadwerkelijk besprak — continu en sample-efficiënt leren — en de aannemelijke vorm van een eerste SSI-model is een demonstratie van een leereigenschap in plaats van een poging om de top van een leaderboard te bereiken. Een systeem dat leert van veel minder data, of blijft leren na uitrol, of elegant degradeert buiten de verdeling, zou precies in lijn met de missie zijn. Een chatassistent met een prijs per miljoen tokens om op codeerbenchmarks te concurreren met GPT-5.6 Sol zou dat niet zijn. We bestempelen dat als redenering op basis van openbare uitspraken, niet als een verslag van wat er bestaat.

Nog een consequentie is het signaleren waard voor iedereen die dit ding zal moeten evalueren. SSI heeft nooit een paper, een benchmarkresultaat of een system card gepubliceerd. Wat er ook verschijnt, zal dus zonder enige externe evaluatiegeschiedenis komen: geen Artificial Analysis-indexvermelding, geen onafhankelijke codeer- of redeneerscore, geen red-team-rapportage van derden, geen community-reproductie. Elk cijfer in de eerste aankondiging zal per definitie door de leverancier zijn gerapporteerd, afkomstig uit een lab dat helemaal geen staat van dienst heeft in het publiceren van cijfers. Houd er rekening mee dat je moet wachten op onafhankelijke meting voordat je iets gelooft, en verwacht dat die meting traag zal verlopen als de release een beperkte onderzoekspreview is in plaats van een open endpoint.

Vijf dingen die dit van gerucht tot nieuws zouden maken.

In plaats van X te verversen, let op specifieke artefacten. In grove volgorde van hoezeer ze zouden bezinken:

Een vierde bericht op ssi.inc/updates. SSI's eigen pagina is de goedkoopst mogelijke bevestiging en het bedrijf heeft die tot nu toe voor elke materiële gebeurtenis gebruikt.

• Een naam. Elke echte release krijgt er een, en het ontbreken van zelfs maar een codenaam in omloop is op zichzelf informatief zo dicht bij een vermeend augustusvenster.

• Een model- of systeemkaart, met elke vermelde capaciteit en elke veiligheidsevaluatie. Voor een lab waarvan het hele verhaal veiligheid-en-capaciteit-in-tandem is, is de kaart de boodschap.

• Een toegangspad: een endpoint, een wachtlijst, een formulier voor een onderzoekspreview of een genoemde partner. Dit is de grens tussen "model" en "product", en het gerucht maakt geen onderscheid tussen beide.

• Een prijs. Prijsstelling is wat een onderzoeksdemonstratie omzet in iets waarop je kunt voortbouwen, en het is het meest waarschijnlijke dat ontbreekt in een eerste SSI-release.

Als er tegen eind augustus geen van die dingen bestaat, is de redelijke conclusie niet dat Baker het mis had, maar dat zijn terloopse opmerking verwees naar iets losser dan een publieke lancering — een interne mijlpaal, een besloten demonstratie aan investeerders, of een timingfoutje van het soort dat elk laboratorium wel eens heeft.

Wat dit verandert voor iedereen die tegenwoordig modellen uitbrengt

Praktisch gezien: nog niets, en het is de moeite waard daar eerlijk over te zijn. SSI's model bestaat niet publiekelijk, niemand host het, wij hosten het niet, en er is geen integratiewerk te doen. Elk artikel dat je vertelt hoe je toegang krijgt, is giswerk.

Waar dit verhaal werkelijk nuttig voor is, is een planningsvraag die nu elke paar weken opduikt: hoe houd je de optie open om een lab te gebruiken dat je nog niet kunt evalueren? Ons antwoord bij OrcaRouter is structureel in plaats van slim. Eén API-sleutel bereikt 200+ modellen, dus het later adopteren van een nieuwe provider is een model-id-wijziging in plaats van een nieuw contract, een nieuwe SDK en een nieuwe factuurrelatie. We geven providerlijstprijzen door met 0% opslag, wat betekent dat wanneer een leverancier zijn prijzen wijzigt — zoals een grote leverancier deed op 30 juli — de nieuwe cijfers dezelfde dag live zijn aan onze kant in plaats van na een marge-herberekening. Automatische failover tussen providers is wat het überhaupt redelijk maakt om echt verkeer naar een onbewezen model te sturen: als een gloednieuw endpoint van een lab met vijftig mensen instabiel is, vallen verzoeken terug op iets dat werkt in plaats van dat je gebruikers falen. En de routing-DSL laat je verschillende modellen combineren in één aanroep, zodat een nieuwkomer kan worden beoordeeld tegen een gevestigde speler op je eigen verkeer voordat het enig pad bezit.

Dat is ook de eerlijke vergelijking die je moet maken terwijl je wacht. De modellen die je vandaag daadwerkelijk kunt aanroepen zijn specifiek en gemeten: GPT-5.6 Sol, aan onze kant vermeld op $5,00 per miljoen invoertokens en $30,00 per miljoen uitvoertokens, een contextvenster van 1M tokens, tot 128K uitvoertokens, en een waargenomen p50 time-to-first-token van 4,07 seconden op de chat-completions- en responses-endpoints. Dat zijn de voorwaarden waarop een productiesysteem wordt gebouwd. Een niet nader genoemd, niet geprijsd, niet gebenchmarkt model van een lab dat niets heeft gepubliceerd, dingt in augustus niet mee naar die plek, wat er ook verschijnt.

Vragen die het daadwerkelijk waard zijn om te beantwoorden

Zal ik SSI's model in augustus kunnen gebruiken?

Onbekend, en minder waarschijnlijk dan de koppen suggereren. De bewering is dat er een model uitkomt, wat niet hetzelfde is als een API, een chatproduct of algemene beschikbaarheid. Sutskever's eigen bewoording was 'geleidelijke release'. Voor een lab dat veiligheid vooropstelt, zonder productorganisatie en met één open engineeringrol, is een beperkte onderzoekspreview of een paper-plus-demo minstens zo aannemelijk als een publiek endpoint. Niemand heeft prijzen, quota's of een toegangsmechanisme gemeld, omdat niemand die heeft.

Hoeveel moet ik Gavin Baker hierin vertrouwen?

Meer dan een anoniem account, minder dan een bedrijfsverklaring. Baker beheert een op technologie gericht fonds met diepe dekking van halfgeleiders en AI en spreekt met mensen in deze laboratoria; de formulering 'SSI zegt' impliceert direct contact. Maar het was een onvoorbereide terzijde in een argumentatie over de vraag naar chips, geen stuk verslaggeving dat hij had voorbereid of op basis van met naam genoemde bronnen. Hij gaf geen dag, geen naam, geen beschrijving en er was geen vervolgvraag. Het is precies zo sterk als 'een goed ingevoerde investeerder gelooft dit, uit de tweede hand' – wat betekenisvol is, en wat geen tijdschema is.

Betekent de NVIDIA-deal dat SSI nu een frontier-scale model traint?

Uiteindelijk, plausibel. In augustus, nee. De 10x is expliciet toekomstgericht over de twaalf maanden na 26 juli 2026, en Vera Rubin-capaciteit die in dat venster wordt geleverd, kan geen model hebben getraind dat weken na de aankondiging is uitgebracht. De deal vertelt je over SSI's ambities voor 2027; het vertelt je bijna niets over wat er deze maand zou kunnen verschijnen.

Waarom heeft een bedrijf zonder product een waardering van $32 miljard?

Omdat beleggers het team en de onderzoeksweddenschap waarderen, niet de omzet. SSI haalde in september 2024 ruwweg $1 miljard op bij een waardering van $5 miljard, en daarna ongeveer $2 miljard bij een waardering van $32 miljard in de eerste helft van 2025 — de berichtgeving verschilt over de vraag of dat in februari, maart of april werd afgerond, waarbij Greenoaks als hoofdinvesteerder wordt genoemd en Alphabet en NVIDIA in sommige verslagen als strategische investeerders verschijnen — gevolgd door de door NVIDIA gerapporteerde $5 miljard in juli van dit jaar. Door dit alles heen: ongeveer vijftig medewerkers, geen product, geen omzet en niet één gepubliceerd paper. Dat is de duidelijkste illustratie die er bestaat van waar waarderingen van frontier-labs werkelijk uit bestaan, en het is ook de reden waarom een eerste model strenger onder de loep zou worden genomen dan welke andere release dit jaar ook.

Wat te kijken

De aanwijzing zal geen lek zijn. Het zal SSI's eigen updatespagina zijn die een vierde item oppikt, of een naam die in omloop komt met een kaart eraan. Totdat een van die dingen gebeurt, is de accurate beschrijving van de stand van de wereld: een geloofwaardige investeerder zei uit tweede hand dat het meest geheimzinnige AI-lab van plan is deze maand iets te laten zien; het lab heeft het niet bevestigd; zijn publieke voetafdruk toont geen voorbereiding; en zijn eigen verkondigde strategie heeft sinds november 2025 ruimte geboden voor precies deze zet. Als het landt, is het eerste waar je op moet letten geen benchmarkscore — het is of de release een product of een bewijs is, omdat SSI's hele stelling is dat die twee verschillende dingen zijn.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

Neem contact op

Word lid van de community

DiscordEmailXGitHubYouTube