Hy4 preview ist das neueste Mixture-of-Experts-Flaggschiff von Tencent: 770B Gesamtparameter, von denen pro Token 49B aktiviert werden, 78 Schichten, 256 geroutete Experten plus 1 geteilter Experte und ein 1M-Token-Kontextfenster. Es ist ein reines Textmodell, das für Coding-Agenten, komplexe Tool-Use-Workflows und Produktivitätsarbeit entwickelt wurde, mit einer nativen MTP-Schicht für spekulative Dekodierung. Reasoning ist auf drei Stufen konfigurierbar (high, low, none) und standardmäßig auf high eingestellt, sodass es als tiefes Chain-of-Thought-Modell für Mathematik, Coding und Analyse laufen oder direkt antworten kann, wenn Latenz wichtig ist. Es unterstützt native Tool-Aufrufe, strukturierte Ausgaben und den vollständigen Sampling-Parametersatz; Tencent empfiehlt temperature 0.9 mit top_p 1.0. Tencent positioniert es für Softwareentwicklung, Büroarbeit und Datenanalyse, Game-Prototyping und wissenschaftliche Forschung und berichtet von einer internen Blindbewertung (163 Experten, 203 Engineering-Aufgaben), bei der Hy4 preview durchschnittlich 2,99 erreichte, gegenüber GLM 5.3 mit 2,92 und Kimi K3 mit 2,94. Als Preview-Release weist Tencent auf bekannte Ecken und Kanten hin, darunter mehr Zeit als nötig auf Reasoning zu verwenden und die eigene Arbeit übermäßig zu verifizieren.
OpenAI-kompatibel — behalte dein bisheriges SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="tencent/hy4-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltyinclude_reasoningmax_completion_tokensmax_tokenspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p| Eingabe / 1M Tokens | $0.834 |
|---|---|
| Ausgabe / 1M Tokens | $2.501 |
| Cache-Lesen / 1M | $0.042 |
| Währung | USD |
Schätzung auf Basis des Listenpreises
Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.
Worüber Entwickler diese Woche sprechen
GET /api/public/models/tencent/hy4-previewÖffnen @misc{orcarouter_hy4_preview,
title = {Hy4 preview API},
author = {Tencent},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/tencent/hy4-preview}
}Tencent. (2026). Hy4 preview API. OrcaRouter. https://www.orcarouter.ai/models/tencent/hy4-preview