Hy4 preview

tencent/hy4-preview
旗舰精选
工具JSON推理
来自 Tencent · 2026-08-28

Hy4 preview 是 Tencent 最新的混合专家旗舰模型:总参数 770B,每个 token 激活 49B,78 层,256 个路由专家加 1 个共享专家,以及 1M token 上下文窗口。它是一款纯文本模型,专为编程智能体、复杂工具使用工作流和生产力工作而构建,并带有用于投机解码的原生 MTP 层。 推理可配置为三个级别(high、low、none),默认 high,因此它既能作为深度思维链模型用于数学、编程和分析,也能在延迟重要时直接回答。它支持原生工具调用、结构化输出和完整的采样参数集;Tencent 推荐 temperature 0.9 和 top_p 1.0。 Tencent 将其定位用于软件工程、办公与数据分析、游戏原型开发和科学研究,并报告了一项内部盲评(163 名专家、203 项工程任务),其中 Hy4 preview 平均得分 2.99,GLM 5.3 为 2.92,Kimi K3 为 2.94。作为预览版本,Tencent 指出其存在一些已知的不完善之处,包括在推理上花费不必要的时间,以及对自己的工作过度验证。

上下文1M tokens
最大输出64K
输入模态text
输出模态text
适用场景reasoning, coding, agentic
p50 首字节3.17 s
输入$0.83/ 百万 tokens
输出$2.50/ 百万 tokens
p50 首字节3.17 s7 天
p95 首字节3.17 s7 天
流量38tokens / 7 天

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="tencent/hy4-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • frequency_penalty
  • include_reasoning
  • max_completion_tokens
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_p

价格

价格
输入 / 1M tokens$0.834
输出 / 1M tokens$2.501
缓存读取 / 1M$0.042
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $13.34 · 启用提示缓存后 $10.57

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.001256

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
3.17 s
输出速度
采集中…
p95 首字节
3.17 s
错误率
0%

公共基准测试

来源: Design Arena

社区热度

本周开发者的讨论

Hacker News0 次提及 · 近 7 天

对比一览

Hy4 previewHy3
输入 $/百万$0.83$0.18
输出 $/百万$2.50$0.59
上下文1.0M262K
质量8/108/10
并排对比并排对比

更多 Tencent 模型

常见问题

在 OrcaRouter 上,Tencent: Hy4 preview 的价格是多少?
Tencent: Hy4 preview 通过 OrcaRouter 的定价为每百万输入 token $0.83,每百万输出 token $2.50。定价从路由层实时获取。
Tencent: Hy4 preview的上下文窗口是多少?
Tencent: Hy4 preview 支持 1M 个 token 的上下文窗口。可使用长上下文功能(RAG、摘要)直至该限制。
如何通过 OpenAI SDK 调用 Tencent: Hy4 preview?
将 OpenAI base_url 设置为 https://api.orcarouter.ai/v1,提供您的 OrcaRouter API 密钥,并在 chat.completions.create 调用中传递 model="tencent/hy4-preview"。
OrcaRouter 是否对 Tencent: Hy4 preview 进行速率限制?
每个模型的速率限制遵循您的 OrcaRouter 计划。免费套餐设有保守的上限;付费套餐则会提升这些上限。请查看 /pricing 了解当前配额。

嵌入此徽章

Tencent: Hy4 preview•$0.83/M in•3175ms p50•通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/tencent/hy4-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/tencent/hy4-preview.svg" alt="Tencent: Hy4 preview 在 OrcaRouter" /> </a>
Markdown [![Tencent: Hy4 preview](https://www.orcarouter.ai/embed/tencent/hy4-preview.svg)](https://www.orcarouter.ai/models/tencent/hy4-preview)

以数据形式获取模型卡

GET /api/public/models/tencent/hy4-preview打开