Gegenereerde titelkaart met de tekst GPT-6 Sol vs Tencent HY4 Preview, het goedkopere model neemt het verkeer voor zijn rekening, met statistiekkaarten met de tekst outputprijs $10,00 vs $2,50 per miljoen, gesloten gewichten vs Apache 2.0 open gewichten, invoeroppervlak tekst, afbeelding, bestand vs alleen tekst, en een voettekst met de tekst GPT-6 Sol-tarieven volgens OpenAI's tariefkaart; Tencent HY4 Preview-tarief en -snelheid volgens OrcaRouter's catalogus, leverancierslijst 6 / 18 yuan per miljoen.
Guides & Insights

GPT-6 Sol vs Tencent HY4 Preview: Het goedkopere model verwerkt zeshonderd keer zoveel verkeer

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Vergelijkingen tussen een frontier-model en een goedkoop model eindigen meestal bij de prijstabel, en deze heeft een betere afloop beschikbaar. Tencent HY4 Preview en GPT-6 Sol worden beide via OrcaRouter gerouteerd, wat betekent dat dezelfde telemetrie beide dekt, en over hetzelfde rollende venster van zeven dagen verwerkte het HY4 Preview-model ruwweg 2,4 miljard tokens tegenover ongeveer 3,9 miljoen voor GPT-6 Sol. Dat is geen benchmark en geen eindoordeel; het is een rollend venster op het verkeer van één platform en volgende week ziet het er anders uit. Maar het is een echt signaal over waar mensen die dingen bouwen daadwerkelijk naar grijpen wanneer een sterk open-weightmodel een kwart van de prijs van het gesloten model kost, en het is het soort cijfer dat een specsheet niet kan produceren.

De twee modellen zijn ook een studie in wat een benchmark je wel en niet kan vertellen. GPT-6 Sol, uitgebracht op 22 september 2026 als het middensegment van OpenAI's GPT-6-generatie, heeft een onafhankelijke Intelligence Index-score. HY4 Preview, uitgebracht en open source gemaakt door Tencent op 28 augustus 2026, heeft geen Artificial Analysis-modelpagina, geen index van derden en helemaal geen onafhankelijk kostencijfer per taak. Alles wat gepubliceerd is over hoe goed het werkt, is Tencent's eigen meting. Die asymmetrie maakt HY4 Preview niet het zwakkere model. Het maakt het het minder geauditeerde model, en dat zijn verschillende beweringen.

De specificaties, waaronder de twee die de meeste deployments bepalen.

• Prijs voor output — GPT-6 Sol $10,00 per miljoen tegenover Tencent HY4 Preview $2,50 per miljoen
• Prijs voor input — GPT-6 Sol $2,00 per miljoen tegenover Tencent HY4 Preview $0,83 per miljoen
• Gecachte input — GPT-6 Sol $0,20 per miljoen tegenover Tencent HY4 Preview $0,04 per miljoen
• Gewichten — GPT-6 Sol gesloten, alleen API tegenover HY4 Preview open source onder Apache 2.0
• Inputmodaliteiten — GPT-6 Sol tekst, afbeelding en bestand tegenover HY4 Preview alleen tekst
• Contextvenster — GPT-6 Sol 1.050.000 tokens tegenover HY4 Preview 1.048.576 tokens
• Maximale output — GPT-6 Sol 128.000 tokens tegenover HY4 Preview 64.000 tokens
• Stap voor lange verzoeken — GPT-6 Sol herprijst het hele verzoek boven 272.000 inputtokens naar $4,00 / $15,00 tegenover HY4 Preview geen tariefstap op de modelkaart
• Architectuur — GPT-6 Sol niet bekendgemaakt tegenover HY4 Preview 770B totale parameters, 49B actief, 78 lagen, 256 gerouteerde experts plus één gedeelde, native multi-tokenvoorspellingslaag
• Onafhankelijke score — GPT-6 Sol 47,6 Intelligence Index tegenover HY4 Preview geen gepubliceerde score
• Gemeten outputsnelheid — GPT-6 Sol ongeveer 244 tokens per seconde tegenover HY4 Preview ongeveer 54, beide voortschrijdende cijfers over zeven dagen

De twee regels die de meeste echte implementaties bepalen, staan het verst onderaan. De eerste is dat HY4 Preview geen beeld- of bestandsinvoer accepteert, waardoor het afvalt voor elke pipeline die ergens naar moet kijken. De tweede is het uitvoerplafond: 64.000 tokens is de helft van GPT-6 Sols 128.000, en bij een model waarvan het opgegeven doel coding agents en lange tool-use-ketens is, is dat de beperking waar een team het eerst tegenaan loopt — niet de kwaliteit, maar het punt waarop een gegenereerd bestand niet meer in één antwoord past.

Daar staat tegenover dat een kwart van de outputprijs en een vijfde van de prijs voor gecachte input heel veel herhaalpogingen opleveren. En de architectuur van HY4 Preview is gedocumenteerd op een manier waarop die van GPT-6 Sol dat niet is: Tencent publiceerde het aantal parameters, het aantal lagen, de expertindeling en de speculatieve-decodingslaag, wat betekent dat de serving-eigenschappen ten minste gedeeltelijk voorspelbaar zijn uit de paper in plaats van alleen waarneembaar via de API.

Generated comparison scoreboard titled GPT-6 Sol vs Tencent HY4 Preview, the scoreboard, with six matched rows. GPT-6 Sol: input $2.00 per million, output $10.00 per million, modalities text image file, weights closed, context window 1,050,000 tokens, Intelligence Index 47.6. Tencent HY4 Preview: input $0.83 per million, output $2.50 per million, modality text only, weights Apache 2.0 open, context window 1,048,576 tokens, no independent score published. A footer reads Tencent HY4 Preview rates per OrcaRouter's catalogue against a vendor list of 6 / 18 yuan per million; GPT-6 Sol figures per Artificial Analysis v4.3.2 and OpenAI.

Wat de benchmarktabel van HY4 Preview eigenlijk is

De door Tencent gepubliceerde cijfers zijn sterk, en ze zijn allemaal door de leverancier gegenereerd. Op Terminal-Bench 2 scoort het model 85,4; op DeepSWE 64,3; en in een brede blinde evaluatie over 203 engineeringtaken scoorde het gemiddeld 2,99 tegenover GLM-5.3 met 2,92 en Kimi K3 met 2,94 — een voorsprong van zeven honderdsten van een punt op een tienpuntsschaal in een door Tencent ontworpen onderzoek. Het debuteerde ook op de Web320-leaderboard, waar Tencent meldt dat het rond de derde plaats en de derde onder open-weightmodellen staat. Het arenaresultaat is door het publiek gestemd in plaats van door de leverancier gegenereerd en is het meest onafhankelijke bewijs in het geheel; de rest is een claim, en een claim is nog steeds het lezen waard als hij als zodanig wordt gelabeld.

Het verschil dat ertoe doet, is niet dat deze cijfers misschien royaal zijn — leveranciersharnassen zijn dat meestal, in beide richtingen. Het is dat er geen tweede meting is om ze mee te vergelijken. Een model met een Artificial Analysis-pagina kan worden gecontroleerd; een model zonder zo'n pagina niet, en het verschil komt maanden later aan het licht wanneer iemand ontdekt dat een headline-cijfer is gemeten met een harnas dat niemand anders kan reproduceren. Niets hier suggereert dat dat met HY4 Preview is gebeurd. Het betekent alleen dat een adoptiebeslissing die op de 85.4 rust, op één bron rust.

De praktische vertaling is dat HY4 Preview op je eigen verkeer moet worden beoordeeld in plaats van op de tabel, en de kostenstructuur maakt dat goedkoop om te doen — tegen een kwart van het outputtarief van GPT-6 Sol kost een week schaduwverkeer met je echte prompts minder dan één enkele API-tierbeoordeling. Dat is de juiste vorm van due diligence voor een onvoldoende gemeten model, en het is de vorm die bijna niemand daadwerkelijk doet.

De open-weightkwestie, die de echte scheidslijn is

HY4 Preview is open source onder Apache 2.0, met naast het basischeckpoint een FP8-build onder een permissieve licentie. GPT-6 Sol is closed source en heeft geen licentebestand, omdat er niets te licentiëren valt. Al het andere in deze vergelijking is een afweging; dit is een categorieverschil.

Wat je daarmee koopt is niet in de eerste plaats een lagere rekening — bij $2,50 per miljoen output zit de gehoste API al onder de kosten die de meeste teams maken voor het draaien van een model met 770 miljard parameters, en als kosten het hele argument waren, zou de permissieve licentie niet ter zake doen. Wat het oplevert is een deployment die niet afhankelijk is van andermans endpoint: gewichten die niet aan rate limiting onderworpen zijn, een checkpoint dat gekwantiseerd kan worden om op de hardware die je hebt te passen, een model dat je kunt fine-tunen, en verkeer dat binnen een netwerkgrens kan blijven. Het antwoord van GPT-6 Sol op alle vier is dat je ze geen van alle nodig zou moeten hebben, wat een echt argument is voor een echte groep teams en een irrelevant argument voor de teams die ze wel nodig hebben.

De modaliteitssplitsing en de licentieregel wijzen dezelfde kant op, wat het vermelden waard is. Een model dat alleen tekst leest en onder Apache 2.0 wordt uitgebracht, is gebouwd als een component — iets dat je in een pipeline stopt die je zelf beheert, en waaraan je tekst voert die je al hebt afgestemd. Een model dat tekst, afbeeldingen en bestanden leest en alleen via een API bereikbaar is, is gebouwd als het toegangspunt, dat de rommelige input direct opvangt. Dat zijn verschillende taken, en een vergelijking die ze op één index rangschikt, beantwoordt een vraag die geen van beide leveranciers heeft gesteld.

OrcaRouter model page for Tencent Hy4 preview (tencent/hy4-preview) by Tencent, dated 2026-08-28, tagged Tools, JSON and Reasoning, describing it as Tencent's latest mixture-of-experts flagship with 770 billion total parameters, 49 billion activated per token, 78 layers, 256 routed experts plus one shared expert and a 1M-token context window, text-only, with a list price of $0.83 per million input and $2.50 per million output and a p50 time to first token of 6.18 seconds.

Ze samen serveren, en wat het verkeersaantal impliceert

Beide modellen zitten achter één OrcaRouter-sleutel met 200+ andere, en de routeringsvorm die deze combinatie suggereert is het omgekeerde van de voor de hand liggende. Zet HY4 Preview vooraan — het is het goedkopere model met een factor vier op output, het is het model met de gedocumenteerde architectuur, en op onze routes is het het model dat de last draagt — en houd GPT-6 Sol erachter voor de verzoeken die een afbeelding moeten lezen, of die meer dan 64.000 tokens moeten uitsturen, of die een kwaliteitscontrole niet doorstaan. De samenstelling wordt uitgedrukt in de routing-DSL in plaats van in applicatiecode, dus de grens tussen de twee is een regel die je kunt aanpassen zonder een deploy.

De snelheidscijfers verdienen een voorbehoud en dan een conclusie. HY4 Preview wordt in ons rollende venster op ruwweg 54 outputtokens per seconde gemeten, tegenover ongeveer 244 voor GPT-6 Sol, en beide zijn waarnemingen op gedeelde infrastructuur in plaats van een gecontroleerde benchmark — vooral het cijfer van Tencent weerspiegelt een model met een zeer groot aantal actieve parameters, en 49 miljard actieve parameters per output. Het goedkopere model is dus met een ruime marge het tragere, precies de afweging die een batchpipeline graag maakt en een interactieve niet. De gehoste build van Tencent kreeg op 7 september ook een prestatieverbetering waarvan de leverancier zegt dat die het aantal redeneerstappen en het tokenverbruik per taak tegelijkertijd vermindert — opnieuw een cijfer van de leverancier, een dat een rekening voorspelt in plaats van een snellere stream.

Failover is wat de combinatie in beide volgordes veilig maakt. Een open-weight model met 770 miljard parameters wordt door meer dan één infrastructuurprovider aangeboden, en een route die kan terugvallen betekent dat een gedegradeerde host een nieuwe poging is in plaats van een storing. Onze catalogus geeft de lijstprijzen van providers door zonder markup, wat ook betekent dat je niet hoeft te wachten op het in valuta opgegeven leverancierstarief: Tencent vermeldt HY4 Preview tegen 6 yuan input en 18 yuan output per miljoen, en het dollarbedrag dat onze pagina toont is dat tarief omgerekend, niet de marge van een wederverkoper.

Artificial Analysis model page for GPT-6 Sol (Max), a proprietary OpenAI model released September 2026, carrying a banner noting the model is deprecated and that OpenAI has launched a newer release, GPT-6.1 Sol. The page shows an Intelligence Index of 48, an output speed of 87.9 tokens per second, $2.00 per million input and $10.00 per million output, a 90% cache discount, and a 1M-token context window.

Waar dit paar eigenlijk voor is

Kies Tencent HY4 Preview voor volume, voor pijplijnen die alleen tekst verwerken en die je zelf beheert, voor alles wat op je eigen hardware moet draaien, en voor elke workload waarbij een fout antwoord kan worden gedetecteerd en opnieuw kan worden geprobeerd — de prijs maakt het opnieuw proberen tot de goedkoopste kwaliteitshefboom die je hebt. Kies GPT-6 Sol wanneer de invoer een afbeelding of een bestand is, wanneer één antwoord meer dan 64.000 tokens moet kunnen bevatten, of wanneer het antwoord naar iemand gaat die erop zal handelen zonder het te controleren. Kies beide als je verkeer van elk wat bevat, wat vrijwel zeker het geval is.

Twee afsluitende controles. HY4 Preview wordt nog steeds als preview aangeduid en blijft het nieuwste Tencent-model in onze catalogus, dus de naam is accuraat in plaats van verouderd — maar een preview kan veranderen terwijl je erop vertrouwt, en een checkpoint met een permissieve licentie kan zonder waarschuwing worden opgevolgd door de eigen definitieve release. En GPT-6 Sol is al vervangen door GPT-6.1 Sol tegen identieke tarieven voor korte context, waarbij de gecachte input is gehalveerd van $0,20 naar $0,10, terwijl de eigen modelpagina van OpenAI lezers nu daarheen verwijst. Als de reden dat je Sol afweegt in plaats van het Tencent-model de acht dagen oude integratie is, dan blijft dat gelden. Als het om capaciteit gaat, is de opvolger degene die je wilt beprijzen.

Vergeleken in dit artikel3

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt