Hy4 preview (Free)

tencent/hy4-preview-free
GRATIS
VerktygJSONResonemang
av Tencent

Hy4 preview är Tencents senaste flaggskepp inom Mixture-of-Experts: 770B totala parametrar med 49B aktiverade per token, 78 lager, 256 routade experter plus 1 delad expert och ett kontextfönster på 1M token. Det är en modell som endast hanterar text, byggd för kodningsagenter, komplexa arbetsflöden för verktygsanvändning och produktivitetsarbete, med ett inbyggt MTP-lager för spekulativ avkodning. Resonemang kan konfigureras på tre nivåer (hög, låg, ingen) och har hög som standard, så den kan köras som en djup chain-of-thought-modell för matematik, kodning och analys, eller svara direkt när latens spelar roll. Den stöder inbyggda verktygsanrop, strukturerade utdata och hela uppsättningen samplingsparametrar; Tencent rekommenderar temperature 0.9 med top_p 1.0. Tencent positionerar den för programvaruteknik, kontorsarbete och dataanalys, spelprototypning och vetenskaplig forskning, och rapporterar en intern blindutvärdering (163 experter, 203 ingenjörsuppgifter) där Hy4 preview i genomsnitt fick 2.99 mot GLM 5.3 på 2.92 och Kimi K3 på 2.94. Som en förhandsversion noterar Tencent kända skavanker, bland annat att den lägger längre tid än nödvändigt på resonemang och öververifierar sitt eget arbete.

ctx1M tokens
Max output64K
Inmatningtext
Utdatatext
p50 TTFT5.25 s
PRISGratishastighetsbegränsad · modellanvändning för 0 $
p50 TTFT5.25 s7d
p95 TTFT10.00 s7d
TRAFIK52.9Mtokens/7d

Kodexempel

import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="tencent/hy4-preview-free",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • frequency_penalty
  • include_reasoning
  • max_completion_tokens
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_p

Priser

$0
Priser
Per förfrågan$0
DebiteringModellanvändning dras aldrig från ditt saldo
Vid överskridandeHTTP 429 när en gräns nås

Behöver du den utan gränserna? tencent/hy4-preview·Så fungerar gratisnivåns gränser →

Prestanda

p50 TTFT
5.25 s
Utdatahastighet
77.0 tok/s
p95 TTFT
10.00 s
Felfrekvens
1.4%

Offentliga benchmarks

Källa: Design Arena

Community-buzz

Vad utvecklare säger den här veckan

Hacker News0 omnämnanden · 7d

Vanliga frågor

Hur mycket kostar Tencent: Hy4 preview (Free) på OrcaRouter?
Tencent: Hy4 preview (Free) prissätts till $0.0000 per förfrågan via OrcaRouter (fast avgift per anrop, debiteras per generering snarare än per token).
Vad är Tencent: Hy4 preview (Free):s kontextfönster?
Tencent: Hy4 preview (Free) stöder ett kontextfönster på 1M tokens. Använd långkontext-funktioner (RAG, sammanfattning) upp till den gränsen.
Hur anropar jag Tencent: Hy4 preview (Free) via OpenAI SDK?
Ställ in OpenAI base_url till https://api.orcarouter.ai/v1, ange din OrcaRouter API-nyckel, och skicka model="tencent/hy4-preview-free" i anropet till chat.completions.create.
Begränsar OrcaRouter hastigheten för Tencent: Hy4 preview (Free)?
Per-modell hastighetsbegränsningar följer din OrcaRouter-plan. Gratisnivåer levereras med konservativa gränser; betalnivåer lyfter dem. Kolla /pricing för aktuella kvoter.

Bädda in denna badge

Tencent: Hy4 preview (Free)•prissättning inväntas•5246ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/tencent/hy4-preview-free" target="_blank"> <img src="https://www.orcarouter.ai/embed/tencent/hy4-preview-free.svg" alt="Tencent: Hy4 preview (Free) på OrcaRouter" /> </a>
Markdown [![Tencent: Hy4 preview (Free)](https://www.orcarouter.ai/embed/tencent/hy4-preview-free.svg)](https://www.orcarouter.ai/models/tencent/hy4-preview-free)

Modellkort som data

GET /api/public/models/tencent/hy4-preview-freeÖppna