Hy4 preview est le dernier modèle phare Mixture-of-Experts de Tencent : 770B de paramètres au total, avec 49B activés par token, 78 couches, 256 experts routés plus 1 expert partagé, et une fenêtre de contexte de 1M de tokens. C’est un modèle texte uniquement conçu pour les agents de codage, les workflows complexes d’utilisation d’outils et les tâches de productivité, avec une couche MTP native pour le décodage spéculatif. Le raisonnement est configurable sur trois niveaux (élevé, faible, aucun) et est défini par défaut sur élevé, de sorte qu’il peut fonctionner comme un modèle de chaîne de pensée approfondie pour les mathématiques, le codage et l’analyse, ou répondre directement lorsque la latence importe. Il prend en charge l’appel d’outils natif, les sorties structurées et l’ensemble complet des paramètres d’échantillonnage ; Tencent recommande une température de 0.9 avec top_p 1.0. Tencent le positionne pour l’ingénierie logicielle, la bureautique et l’analyse de données, le prototypage de jeux et la recherche scientifique, et rapporte une évaluation interne en aveugle (163 experts, 203 tâches d’ingénierie) dans laquelle Hy4 preview a obtenu une moyenne de 2.99 contre 2.92 pour GLM 5.3 et 2.94 pour Kimi K3. En tant que version préliminaire, Tencent signale des imperfections connues, notamment passer plus de temps que nécessaire sur le raisonnement et sur-vérifier son propre travail.
Compatible OpenAI — gardez votre SDK actuel
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="tencent/hy4-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltyinclude_reasoningmax_completion_tokensmax_tokenspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p| Entrée / 1M tokens | $0.834 |
|---|---|
| Sortie / 1M tokens | $2.501 |
| Lecture cache / 1M | $0.042 |
| Devise | USD |
Estimation basée sur le tarif public
Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.
Ce dont parlent les développeurs cette semaine
GET /api/public/models/tencent/hy4-previewOuvrir @misc{orcarouter_hy4_preview,
title = {Hy4 preview API},
author = {Tencent},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/tencent/hy4-preview}
}Tencent. (2026). Hy4 preview API. OrcaRouter. https://www.orcarouter.ai/models/tencent/hy4-preview