Artikel-herokaart met de tekst 'Kimi K3.1 — wat we tot nu toe weten', met drie gestapelde regels: een kalenderpictogram naast 'Abonnementen heropend op 18 september 2026', een tandwielpictogram naast 'Opvolger naar verluidt in post-training — computergebruik, multimodaal', en een vraagtekenpictogram naast 'Geen modelkaart, geen gewichten, geen API-id per 20 september 2026', boven een voettekst met de tekst 'Richting niet geverifieerd; Kimi K3 blijft het enige uitgebrachte model in de reeks.', op een witte achtergrond met zachte blauw- en cyaangradiëntaccenten en het OrcaRouter-logo rechtsonder.
Guides & Insights

Kimi K3.1: Abonnementen zijn terug en een opvolger is naar verluidt in post-training

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Dat een abonnementswachtrij weer opengaat, is een vreemde reden om enthousiast over te worden. Maar het Kimi-bericht dat op 19 september 2026 verscheen, doet twee dingen tegelijk, en het tweede is het interessante: er staat dat Moonshot AI al een nieuwe posttrainingsrun is begonnen voor het volgende model in de Kimi K3-lijn — een run die de auteur van het bericht omschrijft als meer gericht op computergebruik, waarbij er ook werk wordt gestoken in de multimodale ervaring — en dat het volgende model, dat het bericht de volgende Kimi K3.1 noemt, er vóór eind oktober zal zijn.

Niets van die tweede helft is bevestigd. Er is geen modelkaart voor Kimi K3.1, geen gewichten, geen API-id, geen prijs en geen datum. Het enige model in deze familie dat je vandaag kunt aanroepen, is Kimi K3, het open-weight systeem met 2,8 biljoen parameters dat Moonshot op 16 juli 2026 uitbracht. Behandel dit dus als wat het is: een vroeg signaal van een leaker met een echte staat van dienst, dat in dezelfde week komt als één werkelijk controleerbare gebeurtenis.

Die controleerbare gebeurtenis is de reden dat dit een post waard is in plaats van een schouderophalen. De consumentenabonnementen van Kimi waren sinds 20 juli 2026 gesloten, toen Moonshot nieuwe aanmeldingen opschortte omdat de vraag naar K3 groter was geworden dan wat zijn clusters konden bedienen. Twee maanden later zijn ze weer open, met een opnieuw opgebouwde niveaustructuur. Als je stond te wachten om in te stappen: dat deel is echt en het is in de afgelopen paar dagen gebeurd.

De korte versie. Abonnementen: terug, nieuwe niveaus, Code begint nu één niveau hoger dan voorheen. Volgend model: wordt nu post-getraind, gericht op computerg ebruik en multimodaliteit, naar verluidt vóór eind oktober — niet geverifieerd, van één account, en niets om je planning op te baseren. Kimi K3: nu beschikbaar, en nog steeds het enige in dit verhaal dat je daadwerkelijk kunt draaien.

Wat de post zegt, en wat niet

Het signaal is één X-bericht van @chetaslua van 19 september 2026. Het bevat vier beweringen, en die zijn niet even sterk:

Het abonnement is terug. Verifieerbaar, en geverifieerd — zie de volgende sectie.

Er is een nieuwe post-training-run gestart. Niet verifieerbaar door iemand buiten Moonshot. Post-training is de fase na pre-training waarin een model wordt bijgesteld tot een bruikbaar product; "er is een nieuwe run gestart" vertelt je ongeveer waar een opvolger zich in de pijplijn bevindt, en niets over wanneer die uitkomt.

Het is meer gericht op computergebruik, met verbeteringen aan de multimodale ervaring. Dit is een richting, geen specificatie. Het is ook de minst verrassende bewering in het bericht, om redenen die hieronder uiteengezet moeten worden.

Het volgende model komt vóór eind oktober. Een datum. Datums uit lekken zijn het meest toetsbare dat iemand publiceert, en de vorige Kimi-datum van dit account klopte niet — meer daarover in de tijdlijn.

Wat ontbreekt, is precies wat je eigenlijk zou willen: parameteraantal, contextlengte, prijs, licentie, benchmarkscores, of enige aanwijzing of dit een puntrelease in de trant van Kimi K3.1 is of iets groters. De post zegt het niet, en niets dat sindsdien is gepubliceerd heeft het gat gevuld. Er is ook een naamgevingsprobleem. In lekken is sinds juli "K3.1" opgedoken, voorspellingsmarkten en gray-test-watchers hebben gewezen op een "volgend K-serie-model", en rapporten hebben op uiteenlopende wijze gezinspeeld op K3.1, K3.2 en K4. Dat zijn drie verschillende producten. Deze post maakt niet duidelijk welke het beschrijft.

Het deel dat je kunt controleren: abonnementen weer geopend

Moonshot pauzeerde op 20 juli 2026 nieuwe consumentenabonnementen, vier dagen nadat K3 was gelanceerd, met de mededeling dat de vraag de grenzen van zijn bestaande clusters had benaderd en dat beschikbare rekenkracht zou worden omgeleid naar gebruikers die al hadden betaald. Nieuwe plekken zouden in batches weer opengaan naarmate er capaciteit werd toegevoegd. Die pauze duurde ongeveer twee maanden.

Op 18 september 2026 werden de abonnementen heropend, waarbij de niveaus werden hernoemd en de prijzen werden aangepast naar dezelfde jaarlijkse totalen als de oude:

• Go — 468 yuan/jaar, ongeveer 39 yuan per maand

• Plus — 948 yuan/jaar, ongeveer 79 yuan per maand

• Pro — 1.908 yuan per jaar, ongeveer 159 yuan per maand

• Max — 6.708 yuan per jaar, ongeveer 559 yuan per maand

Twee wijzigingen zijn belangrijker dan de prijzen, die niet zijn veranderd. Ten eerste werd het plan om Kimi Code apart te verkopen grotendeels ingetrokken onder druk van gebruikers — Plus, Pro en Max bevatten het nog steeds allemaal. Ten tweede bevat het goedkoopste abonnement het niet meer, waardoor de instapprijs voor Code effectief steeg van 468 naar 948 yuan per jaar. In communitythreads wordt ook gemeld dat wekelijkse limieten zijn verwijderd terwijl de quota werden verlaagd, en dat het 1M-tokenvoordeel voor lange context is opgeschoven van het oude middenabonnement naar Max. Die laatste twee zijn gebruikerscommentaar in plaats van een officiële uitsplitsing, en het zijn precies van die details die bepalen of een abonnement het kopen waard is — controleer ze aan de hand van je eigen gebruik voordat je je een jaar vastlegt.

Als je buiten China bent, is het beeld op een belangrijk punt anders: de bovenstaande niveaus zijn de binnenlandse consumentenabonnementen, en wat je daadwerkelijk kunt kopen, en tegen welke prijs, hangt af van de regio. Voor API-toegang in het bijzonder houdt niets hiervan je tegen — de Kimi API is een apart product, los van het consumentenabonnement, en maakte nooit deel uit van de pauze.

Waarom "computergebruik en multimodaal" de minst verrassende bewering in de post is

Moonshot bouwt al een jaar precies naar dit punt toe, en daarom is de richting geloofwaardig, ook al is de tijdlijn dat niet.

Kimi Work, Moonshot's desktopagent voor macOS en Windows, werd geleverd met een Computer Use-mogelijkheid: het leest het scherm en verzorgt klikken, scrollen en typen, en het draait op de achtergrond in plaats van je muis over te nemen. Daaronder drijft een browserbrug een echte ingelogde Chrome- of Edge-sessie via het DevTools-protocol aan voor navigatie, klikken en het invullen van formulieren. Daaromheen heeft het bedrijf Agent Swarm gebouwd voor maximaal 300 parallelle subagenten, een doelmodus die urenlang blijft itereren op een uitkomst, en een planner voor terugkerende taken. Dat is een productoppervlak dat een model nodig heeft dat goed is in het zien van een scherm, het bepalen van een actie en het controleren van het resultaat.

K3 zelf was al die kant op gericht. Het ondersteunt native beeldinvoer, en het lanceermateriaal leunde zwaar op agentisch werk met een lange horizon — het lezen van de omgevingstoestand, het aanroepen van tools, het inspecteren van resultaten, het bijsturen — wat computergebruik is in alles behalve de naam. Moonshots eigen technische rapportage beschrijft trainingstaken die kunnen oplopen tot duizenden tool-aanroepen, terwijl ze de status van bestanden, applicaties en virtuele machines behouden. Een opvolger waarvan de post-training-run expliciet meer gewicht toekent aan computergebruik is de voor de hand liggende volgende stap, geen koerswijziging.

Multimodaliteit is hetzelfde verhaal. De K2.5-generatie introduceerde een "zero-vision"-fine-tuningfase — supervisie met alleen tekst die werd gebruikt om visueel redeneren en het aanroepen van tools intact te houden — gevolgd door multimodale reinforcement learning. K3 behield een vision-encoder uit de MoonViT-familie en native beeldbegrip. "Het verbeteren van de multimodale ervaring" is hoe continu werk aan die stack er van buitenaf uitziet.

Niets hiervan maakt de bewering waar. Het maakt haar aannemelijk, wat iets anders en veel zwakkers is. Aannemelijke richtingen zijn waar lekken het beste in zijn; ze zijn ook waar lekken het slechtst in zijn als het op dateren aankomt.

Vier dates, drie ervan fout.

De nuttigste manier om dit bericht te lezen is als de vijfde bijdrage in een reeks, omdat de reeks een staat van dienst heeft:

16 juli 2026 — Kimi K3 wordt uitgebracht. Het enige bevestigde item op deze lijst. 2,8 biljoen parameters, Mixture-of-Experts, context van 1 miljoen tokens, native beeldinvoer, open gewichten.

26 juli 2026 — de eerste K3.1-leak. Een enkel X-bericht met een lijst van geruchten over verbeteringen: snellere inferentie, betere token-efficiëntie bij lang redeneren, stabielere coding- en agent-workflows, minder verspilde redeneerstappen, nog steeds open-weight. Geen cijfers, geen datum, en het eindigde met de vraag aan lezers of zij dachten dat het zou winnen — de vorm van speculatie, geen briefing.

18 augustus 2026 — de eerste datum. Een follow-up van dezelfde leaker zette het volgende Kimi-model tegenover de beste propriëtaire systemen en zei dat het in augustus verwacht werd. Augustus eindigde zonder release. Dit is het enige element van het hele verhaal dat ooit testbaar is geweest, en het is niet uitgekomen.

18 september 2026 — de teaser. Moonshots eigen account publiceerde een lange cijferreeks en verwijderde die; de community interpreteerde het als de decimale expansie van π, met de "3.1" aan het begin weggelaten. Van de leverancier, uit tweede hand en niet verifieerbaar, omdat het bericht verdwenen is.

19 september 2026 — deze post. Abonnementen bevestigd, een run na de training geclaimd, een nieuwe deadline: voor het einde van oktober.

Er is hier een patroon dat het waard is om te benoemen. De richting van deze lekken is al twee maanden consistent — efficiëntie, betrouwbaarheid, agents, computergebruik, multimodaal — en elke datum die eraan hing, is opgeschoven. Een lek kan gelijk hebben over wat eraan komt en ernaast zitten over wanneer, en dat is bij dit lek tot nu toe precies het geval. De teaser van 18 september maakt het beeld in de andere richting ingewikkelder: een leverancier die een teaser deelt over zijn eigen opvolger is een sterker signaal dan de puntenlijst van een leaker, omdat een bedrijf dat ergens een teaser over deelt, het in een of andere vorm heeft. Maar de teaser bevatte ook geen datum, en het bericht dat hierop volgt is van de leaker, niet van Moonshot.

Wat is er daadwerkelijk bevestigd, en wat moet er vandaag draaien?

A generated single-column scoreboard titled 'Kimi K3 — the scoreboard' with six rows: Parameters 2.8T MoE, ~104B active; Context window 1,048,576 tokens; Input modalities text + image; Price $3.00 in / $15.00 out per M tokens; Frontend Code Arena #1 at launch, ~1,679 Elo; Open weights released July 2026. A footer reads 'Kimi K3 figures as reported by Moonshot at launch, July 2026; price per OrcaRouter.'

Kimi K3 is het echte model in dit verhaal. Het werd uitgebracht op 16 juli 2026, met gewichten en een technisch rapport die op 27 juli volgden; het is een sparse Mixture-of-Experts-systeem met 2,8 biljoen parameters, 896 experts en ongeveer 104 miljard actieve parameters per token, gebouwd op Kimi Delta Attention en Attention Residuals, met een contextvenster van 1M tokens en native beeldinvoer. Het veroverde bij de lancering de eerste plaats in de onafhankelijke Frontend Code Arena met een gerapporteerde ~1.679 Elo, vóór Claude Fable 5 en GPT-5.6 Sol, en behaalde een gerapporteerde 93,5% op GPQA Diamond. Bestempel die als cijfers ten tijde van de lancering, niet als vaststaande cijfers — de ranglijsten en de modellen rond K3 zijn sindsdien opgeschoven, en de scores komen uit Moonshots eigen materiaal bij de release.

Screenshot of the Artificial Analysis model page for Kimi K3 (max), tagged 'Open weights model' and 'Released July 2026', showing four highlight cards — Intelligence at rank 2 of 113 with an Artificial Analysis Intelligence Index of 44, Speed at rank 50 with 38.9 output tokens per second, Cost at rank 33 with In $3.00 and Out $15.00 per 1M tokens and a 90% cache discount, and Verbosity at rank 24 with 160M output tokens — plus a technical specifications panel listing a 1M context window, 2.8T total parameters, 104B active parameters and Hugging Face model weights, and a comparison summary that calls the model notably slow at 39 tokens per second and expensive against a $0.30 median input price.

Wat niet is veranderd, is dat K3 echt sterk is in datgene waarvoor de opvolger volgens de gelekte informatie wordt getraind. Langetermijnagentwerk met vision in the loop — waarbij het model kijkt naar wat het heeft geproduceerd en dat corrigeert — is waar het voor is gebouwd om te concurreren, en het is de reden dat de "computer use"-claim in het bericht van 19 september als continuïteit overkomt in plaats van als nieuws.

Kimi K3 is beschikbaar via OrcaRouter als kimi/kimi-k3, naast Kimi K2.5, Kimi K2.6 en Kimi K2.7 Code, op één OpenAI-compatibel endpoint. Dat is belangrijker dan gewoonlijk wanneer er een lek in de lucht hangt. OrcaRouter geeft de lijstprijs van de provider door tegen 0% opslag, dus als Moonshot de prijs van K3 verlaagt — wat de realistische vorm is van een "successor ships"-gebeurtenis voor iedereen die er al op bouwt — staat de nieuwe prijs dezelfde dag bij ons live, zonder dat er een contract opnieuw onderhandeld hoeft te worden. En wanneer een model dat je nog niet kunt verifiëren er dan toch komt: failover is hoe je het uitprobeert zonder er een productiepad aan te wagen: leid een deel van het echte verkeer erheen, houd het bewezen model als fallback, en laat de router verzoeken terugsturen als het nieuwe model zich misdraagt.

Screenshot of the OrcaRouter model page for Kimi K3, showing the product id kimi/kimi-k3 with a FEATURED badge, a context window of 1M tokens, text and image input with text output, a p50 time to first token of 8.62 seconds, input pricing of $3.00 per 1M tokens and output pricing of $15.00 per 1M tokens, seven-day p50 and p95 TTFT of 8.62 s and 10.00 s, 1,790.3M tokens of traffic over seven days, the /v1/chat/completions and /v1/responses endpoints, and a Python code sample pointing at the base URL https://api.orcarouter.ai/v1.

Hoe dit stuk eruit zal zien als het verkeerd is

De eerlijke test voor een lekverslag is of het de dingen noemde die het zouden ontkrachten. Dus concreet: hier is wat dit zou beslechten — en wat het zou nekken.

Een Hugging Face-repository of een modelkaart van Moonshot is de enige harde bevestiging. Niets anders in deze pipeline is door een lezer te controleren.

Een nieuw model-id in de eigen modellenlijst van de Kimi API zou een release al bevestigen nog voordat de weights beschikbaar komen.

Een anonieme inzending in een blinde arena is een zwak instrument en moet als zodanig worden behandeld. Eerder dit jaar was een groot deel van de community ervan overtuigd dat een anonieme codenaam in Code Arena het volgende Kimi-model betrof dat in een grijze test werd getest, op basis van Moonshots naamgevingspatroon bij eerdere releases; een tokenizer-vingerafdruk wees diezelfde inzending later toe aan een heel andere modelfamilie. Een arenaclabel is een gok over identiteit, geen bewijs ervan.

Stilte tot en met oktober zou dit de tweede opeenvolgende gemiste datum van hetzelfde account maken, en zou de redelijke verwachting voor een opvolger naar volgend jaar verschuiven — wat niet hetzelfde is als dat het model niet bestaat.

Als je deze week iets besluit, baseer het dan op het nieuws over abonnementen, dat echt is, en op Kimi K3, die wordt uitgeleverd. De opvolger is een richting met een deadline die eraan is verbonden door iemand die niet bij Moonshot werkt, en de juiste hoeveelheid planning eromheen is nihil.

Vragen die mensen daadwerkelijk stellen

Is Kimi K3.1 uitgebracht?

Nee. Met ingang van 20 september 2026 is er geen modelkaart, geen gewichten, geen API-id en geen prijs voor iets dat Kimi K3.1 heet. Het enige uitgebrachte model in de reeks is Kimi K3, van 16 juli 2026.

Moet ik erop wachten voordat ik een build start?

Nee — en het nieuws over het abonnement is de reden. Als je nu K3-klasse capaciteit nodig hebt, is die vandaag beschikbaar en is de prijs niet gestegen. Als je de eerste wilt zijn met een opvolger, is de goedkope manier om je voor te bereiden: bouwen tegen een endpoint dat naar een nieuw model-id kan routeren op de dag dat het verschijnt, in plaats van een integratie te herschrijven rond een model dat nog geen gepubliceerd API-oppervlak heeft.

Omvat het heropende abonnement API-toegang?

Nee. De Go-, Plus-, Pro- en Max-niveaus zijn consumentenabonnementen voor Kimi's web-, app- en agentproducten, en voor Kimi Code bij de bovenste drie niveaus. API-toegang wordt apart gefactureerd, per token, en maakte nooit deel uit van de julipauze.

Wat betekent "meer gericht op computergebruik" in de praktijk?

Het betekent post-training met meer nadruk op schermlezen en GUI-acties — het model kijkt naar een interface, beslist wat het moet aanklikken of typen, en controleert of het resultaat klopte. Moonshot levert die capaciteit al in Kimi Work en traint K3 al op lange tool-call-runs met behouden applicatie- en virtualmachine-status, dus een opvolger die verder in die richting is bijgestuurd, is de verwachte volgende stap in plaats van een nieuwe productlijn.

Het volgende echte datapunt is niet nog een bericht. Het is een repository, een modelkaart of een model-id. Totdat een van die dingen opduikt, is alles na de abonnementsregel in dat bericht van 19 september een claim met een datum eraan vast — en de datum is precies het onderdeel waarop dit account het al eens eerder mis heeft gehad.