Hy3

tencent/hy3
NyUtvalt
VerktygJSONResonemang
av Tencent · 2026-07-06

Hy3 är Tencent Hunyuans produktionsklara expertblandningsmodell — 295B totala parametrar med endast 21B aktiva per pass (192 experter, top-8-routning), den uppgraderade utgåvan som bygger på Hy3-preview-serien. Den utökar RL-träningsskalan och datakvaliteten efter träning för ytterligare förbättringar inom resonemang, långa sammanhang och agentbaserade uppgifter, med resultat som kan jämföras med flaggskeppsmodeller flera gånger dess parameterstorlek. Den har ett 256K-tokens kontextfönster (text in, text ut) med konfigurerbar resonemangsinsats och är byggd för verklig kodning, verktygsanvändning och flerstegsagentarbetsflöden med ett starkt förhållande mellan kvalitet och kostnad.

ctx262.1K tokens
Inmatningtext
Utdatatext
p50 TTFT3.89 s
INMATNING$0.18/ 1M token
UTDATA$0.59/ 1M token
p50 TTFT3.89 s7d
p95 TTFT10.00 s7d
TRAFIK1302.2Mtokens/7d

Tencent Hy3 är en textbaserad stor språkmodell utvecklad av Tencent. Den är designad för att bearbeta och generera text med ett kontextfönster på 262 144 tokens, vilket gör att den kan arbeta med…

Vad är Tencent Hy3?

Vem skulle dra nytta av att använda Tencent Hy3?

Vad är de viktigaste tekniska specifikationerna?

Hur fungerar prismodellen?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="tencent/hy3",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_p

Priser

Inmatning / 1M token$0.180
Utdata / 1M tokens$0.590
Cacheläsning / 1M$0.059
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $3.03 · Med promptcachning $2.61

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000298

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
3.89 s
Utdatahastighet
140 tok/s
p95 TTFT
10.00 s
Felfrekvens
5.5%

Offentliga benchmarks

58.8
AA Coding
Bättre än 76% av jämförda modeller
#29 av 123
41.2
AA Intelligence
Bättre än 70% av jämförda modeller
#38 av 125
AA-LCR
73.4
BrowseComp
84.2
ClawEval (pass^3)
68.5
FrontierScience-Olympiad
74.8
GPQA Diamond
89.7
HLE (with tools, text-only)
53.2
Humanity's Last Exam
31.6
Long-Context Recall
66.7
MathArena Apex
38.7
MCP Atlas (public)
79.1
NL2repo
45.6
SciCode
47.6
SkillsBench (text-only)
55.3
SWE-bench Multilingual
75.8
SWE-bench Pro
57.9
tau_banking
20.8
Terminal Bench 2.1
71.7
terminalbench_v2_1
64.4
Källa: artificialanalysis.ai, tencent

Vanliga frågor

Vad är kostnaden för att använda Tencent Hy3?
$0.18 per 1 miljon inmatningstokens och $0.59 per 1 miljon utmatningstokens, fakturerad till leverantörens exakta taxa utan påslag via OrcaRouter.
Vad är storleken på kontextfönstret?
262 144 tokens.
Vilka är de främsta styrkorna hos Tencent Hy3?
Dess mycket stora kontextfönster (262k) och starka prestanda på BrowseComp benchmark (84.2) gör det idealiskt för analys av långa dokument. Prissättningen är konkurrenskraftig för dess kontextstorlek.
Hur står sig Tencent Hy3 mot mindre, billigare modeller?
Det är bättre för uppgifter som kräver en stor kontext utan chunking, men för korta inmatningar är mindre modeller snabbare och billigare.
Delar OrcaRouter mina data med Tencent?
Datahanteringspolicyer anges i OrcaRouters användarvillkor; inga specifika delningsdetaljer tillhandahålls för denna modell.
Hur anropar jag Tencent Hy3 med OpenAI Python client?
Ställ in openai.api_base = 'https://api.orcarouter.ai/v1', openai.api_key = 'din-nyckel', och använd model='tencent/hy3'.
Kan jag strömma svar från Tencent Hy3?
Ja, sätt parametern 'stream' till true i API-anropet enligt standard OpenAI streaming.
Vad är den maximala utdatalängden?
Du kan ställa in max_tokens upp till det återstående kontextfönstret efter inmatning, men ingen specifik utgångsgräns annonseras.

Bädda in denna badge

Tencent: Hy3$0.18/M in3892ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/tencent/hy3" target="_blank"> <img src="https://www.orcarouter.ai/embed/tencent/hy3.svg" alt="Tencent: Hy3 på OrcaRouter" /> </a>
Markdown [![Tencent: Hy3](https://www.orcarouter.ai/embed/tencent/hy3.svg)](https://www.orcarouter.ai/models/tencent/hy3)

Modellkort som data

GET /api/public/models/tencent/hy3Öppna