Hero-titelkaart voor 'Tencent HY4 Preview vs tencent-hy3'. Een kop luidt 'Zes keer de prijs — en wat de sprong daadwerkelijk oplevert'. Linkerpaneel 'Tencent HY4 Preview' (NIEUW VLAGGSCHIP, 28 aug 2026) met chips '770B / 49B MoE', '1M context', 'DeepSWE 64.3'. Rechterpaneel 'tencent-hy3' (BEWEZEN WERKPAARD) met chips '295B / 21B MoE', '256K context', 'DeepSWE 28.0'. Een voettekst luidt 'Prijs ¥6/¥18 vs ¥1/¥4 per MTok. Benchmarks leveranciersgerapporteerd.'
Guides & Insights

Tencent HY4 Preview versus tencent-hy3: Zes keer de prijs, en wat de sprong daadwerkelijk oplevert

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Tencent HY4 Preview is het eerste model in de Hunyuan-familie dat zijn eigen voorganger opzettelijk goedkoop laat lijken: Tencent hanteert een invoerprijs die zes keer zo hoog ligt als die van tencent-hy3 en een uitvoerprijs die vier en een half keer zo hoog ligt, en in het introductiedocument wordt beargumenteerd dat de meerprijs verdiend is. Tencent HY4 Preview, uitgebracht en als open source beschikbaar gesteld op 28 augustus 2026, rapporteert een software-engineering score op DeepSWE die ruim het dubbele is van Hy3's 28,0, een 85,4 op Terminal-Bench 2.1 voor terminalbediening, en een contextvenster dat groeit van 256K naar meer dan een miljoen tokens. tencent-hy3, dat op 6 juli officieel werd, is de volwassen werkpaard van de familie — 295B totale parameters, 21B actief, een kwart van de context, en een prijskaartje dat dichter bij een afrondingsfout ligt. Dit is geen wedstrijd die het specificatieblad spannend maakt. De vraag is of de kloof het geld waard is voor wat je daadwerkelijk draait, en het antwoord verschilt per werklast.

Het scorebord: waar de twee daadwerkelijk uiteenlopen

Elke benchmark in Tencent's materialen is leveranciersgerapporteerd — uitgevoerd op Tencent's eigen evaluatie-opstellingen bij de lancering van elk model, niet gereproduceerd door een onafhankelijk laboratorium, en voor het vlaggenschip is het model nog geen dag openbaar. Beschouw de scores als het plafond waarvan Tencent gelooft dat het het heeft bereikt, en weeg het patroon zwaarder dan enig afzonderlijk cijfer. Het patroon is onmiskenbaar, en het is geconcentreerd op agentisch engineeringwerk in plaats van algemene kennis.

DeepSWE — Tencent HY4 Preview: 64.3. tencent-hy3: 28.0. Dit is de grootste sprong in de vergelijking, meer dan een verdubbeling op een repository-omvattende software-engineeringbenchmark, en het is het getal dat een chatmodel onderscheidt van een model waaraan je een volledige codebase toevertrouwt.

• Terminal-Bench 2.1 — Tencent HY4 Preview: 85,4, waarmee het volgens Tencent Claude Opus 5 evenaart en DeepSeek V4 Pro voorbijgaat. tencent-hy3: 71,7 zoals gerapporteerd bij de lancering in juli. Een echte terminal volledig laten doorlopen bij meerstapstaken is precies het soort langetermijnwerk waar Hy3 het zwakst in was.

Toolathlon-geverifieerd — Tencent HY4 Preview: 74,1, die volgens Tencent Qwen 3.8 Max en GPT-5.6 Sol overtreft. Er is geen vergelijkbaar Hy3-cijfer gepubliceerd.

• Interne blinde test — 163 experts beoordeelden 203 technische taken en gaven Tencent HY4 Preview 2,99/4,00, waarmee het GLM-5.3's 2,92 en Kimi K3's 2,94 nipt voorbleef. Dit zijn beoordelaars van Tencent die Tencent-taken beoordeelden; beschouw het als richtinggevend.

A two-column comparison scoreboard titled 'Tencent HY4 Preview vs tencent-hy3 — the scoreboard'. Left column 'Tencent HY4 Preview': 'Total / active params: 770B / 49B', 'Context window: 1M', 'DeepSWE: 64.3', 'Terminal-Bench 2.1: 85.4', 'Input price per MTok: ¥6 (~$0.85)', 'Output price per MTok: ¥18 (~$2.50)'. Right column 'tencent-hy3': 'Total / active params: 295B / 21B', 'Context window: 256K', 'DeepSWE: 28.0', 'Terminal-Bench 2.1: 71.7', 'Input price per MTok: ¥1 (~$0.14)', 'Output price per MTok: ¥4 (~$0.56)'. A footer reads 'Benchmarks vendor-reported by Tencent at each model's launch.'

De rode draad: de winst zit in terminalbesturing, toolaanroeping en taken op repository-schaal — de productiviteitspositionering die Tencent sinds Hy3 uitdraagt, nu met de rekenkracht om het te ondersteunen.

De prijspremie, regel voor regel

Hier draait de vergelijking niet langer om opscheppen. Tencent's lijstprijzen, per miljoen tokens:

Tencent HY4 Preview: 6 yuan (~US$0,85). tencent-hy3: 1 yuan (~US$0,14). Zes keer.

Output — Tencent HY4 Preview: 18 yuan (~US$ 2,50). tencent-hy3: 4 yuan (~US$ 0,56). Vier en een half keer.

• Cache-hit — Tencent HY4 Preview: 0,3 yuan. tencent-hy3: 0,25 yuan. Bijna hetzelfde, wat belangrijker is dan het lijkt, omdat agentische lussen voortdurend dezelfde system prompt en gespreksprefix opnieuw verzenden.

Voer een realistische agentische codeerworkload uit via het gemengde aantal — bijvoorbeeld 20 miljoen invoer- en 4 miljoen uitvoertokens per maand, een druk budget voor een enkele ontwikkelaar-agent. Tencent HY4 Preview: 120 yuan plus 72 yuan, ongeveer 192 yuan (~US$ 27). tencent-hy3: 20 yuan plus 16 yuan, ongeveer 36 yuan (~US$ 5). Het vlaggenschip kost meer dan vijf keer zoveel om te draaien met dezelfde tokenmix — en het zal meer uitvoertokens per taak vragen, omdat het langer nadenkt.

Dat is geen reden om Tencent HY4 Preview te vermijden; de DeepSWE-sprong is precies het soort mogelijkheid waarvoor een premium bestaat om te kopen. Het is een reden om de workload te prijzen voordat je deze routeert. En het is de plek waar de routeringslaag zijn bestaansrecht verdient: tencent-hy3 staat al op OrcaRouter tegen de lijstprijs van de provider — 0% opslag, dus het getal dat je ziet is de eigen prijs van de serverprovider, geen doorverkochte en opgewaardeerde versie ervan — met automatische failover tussen providers, en een wijziging van de leveranciersprijs gaat dezelfde dag live aan onze kant.

Vier keer de context, het dubbele aan actieve compute

• Architectuur — Tencent HY4 Preview: 770B totaal, 49B actieve MoE. tencent-hy3: 295B totaal, 21B actief. Het vlaggenschip besteedt ruwweg 2,3 keer zoveel compute aan elk token.

Context window — Tencent HY4 Preview: meer dan 1M tokens. tencent-hy3: 256K. Een volledige repository of een batch financiële documenten past in het venster van het vlaggenschip als één enkele aanvraag; op Hy3 vereist dezelfde taak chunking, retrieval of een agent-lus.

• Reasoning-controle — tencent-hy3 wordt geleverd met een per-verzoek reasoning_effort-instelling (no_think, low, high) plus een speculatieve-decoderinglaag die het snel houdt. Tencent HY4 Preview neigt, naar Tencents eigen erkenning, tot lang nadenken vóór de eerste output en overmatige zelfcontrole bij complexe taken — waardoor tokens worden verspild aan het dubbelchecken van werk dat al is gedaan.

Die laatste regel is het subtiele verschil dat er toe doet voor gebruik waarbij latentie gevoelig ligt. Hy3 kan worden gevraagd direct te antwoorden; Tencent HY4 Preview kan het in ieder geval in deze vroege vorm vaak niet laten om na te denken. Voor een chat met lage latentie of een extractiepijplijn met hoge doorvoer, zijn de extra mogelijkheden van het vlaggenschip verspild en is het extra nadenken een belasting. Voor een offline batchtechnische klus is die belasting precies wat het betere antwoord oplevert.

De previewbelasting: wat Hy3 nog heeft

"{{1}}Preview{{/1}}" zit in de naam van Tencent HY4 Preview en het gedraagt zich ook zo. Er is geen {{2}}visie of multimodale invoer{{/2}} — het model is {{3}}alleen-tekst{{/3}}, dus alles wat {{4}}beeld- of video-gerelateerd{{/4}} is, blijft bij het model dat je daar al voor gebruikt. De {{5}}gratis proefperiode van twee weken{{/5}} op {{6}}WorkBuddy en CodeBuddy{{/6}} is een voorproefje, geen plan. Tencent heeft duidelijk gemaakt dat dit een {{7}}vroege iteratie{{/7}} van Hy4 is, met {{8}}verbeteringen aan pre-training en post-training{{/8}} die nog gaan komen in een tempo dat sinds februari ongeveer {{9}}elke twee maanden{{/9}} een grote versie heeft opgeleverd. Onafhankelijke benchmarks voor het vlaggenschip: {{10}}nog geen, nergens{{/10}}.

tencent-hy3 is het tegenovergestelde van dat alles. Het is een officiële, stabiele release die sinds juli in productie is. De gratis laag loopt tot 30 september. Zijn redeneerniveaus geven je een draaiknop in plaats van een temperament, en de laag voor speculatieve decodering en 21B actieve parameters maken het de goedkope, snelle, voorspelbare helft van deze familie — het model dat je op het standaardpad richt en vergeet.

Screenshot of Tencent's official Hugging Face model card for the Hy4 Preview release, showing the model's open-weights download options, the 770B-parameter mixture-of-experts specification, and the million-token context window.

Wie moet welke kiezen

Kies {{1}}Tencent HY4 Preview{{/1}} wanneer de taak het punt is — een lastige software-engineering-opdracht, een context op repository-schaal, een agentische workflow waarin een beter antwoord vijf keer de tokenrekening rechtvaardigt en je de latentie kunt veroorloven van een model dat nadenkt voordat het spreekt. Kies {{2}}tencent-hy3{{/2}} wanneer de beperking het punt is — hoge doorvoer, lage latentie, een krap budget, of elke taak waarbij je wilt dat het model antwoordt in plaats van overlegt.

Het praktische patroon voor een dergelijke koppeling is escalatie: routeer het goedkope, beheersbare model op het standaardpad en escaleer alleen naar het vlaggenschip wanneer de taak dat vereist. Daar is de routing-DSL van OrcaRouter voor bedoeld — om meerdere modellen in één aanroep te combineren, zodat het beleid configuratie is in plaats van code — en automatische failover betekent dat het pad van Hy3 blijft werken, zelfs als een provider achteruitgaat. OrcaRouter routeert Tencent HY4 Preview nog niet; Tencent heeft het model niet opengesteld voor inferentie door derden, dus voorlopig draait het op het eigen Tencent Cloud TokenHub-endpoint van de leverancier en op self-hosted implementaties van de open gewichten. tencent-hy3 staat ondertussen vandaag in de catalogus tegen de lijstprijs van de provider — en op de dag dat het vlaggenschip beschikbaar komt, past het op dezelfde manier in dezelfde routinglaag, waardoor de overstap van het ene model naar het andere een wijziging van één regel wordt in plaats van een herschrijving.

Screenshot of the OrcaRouter model page for tencent/hy3, showing its provider list price and availability through the one-API routing catalog — the half of this family that can be routed today.

Het oordeel is saai op de beste manier: het vlaggenschip is de meerprijs waard voor precies het werk waarvoor het geprijsd is, en het werkpaard is nog steeds de juiste keuze voor alles dat gewoon gedaan moet worden. Het zesvoudige prijsverschil is reëel, de 28-tot-64 DeepSWE-kloof is reëel, en geen van beide heft de ander op — je moet gewoon weten welke je koopt.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube