Qwen3.8 Max (0902)

qwen/qwen3.8-max-0902
视觉工具JSON推理
来自 Qwen · 2026-09-02

日期为2026年9月2日的Qwen3.8 Max快照,这是阿里巴巴的旗舰多模态推理模型:输入文本+图像+视频,输出文本,支持100万token上下文。功能与定价与基础模型保持一致;将其固定下来以获得可复现的行为。

上下文1M tokens
最大输出131K
输入模态text + image + video
输出模态text
p50 首字节1.80 s
输入$2.00/ 百万 tokens
输出$6.00/ 百万 tokens
p50 首字节1.80 s7 天
p95 首字节2.80 s7 天
流量9.7Ktokens / 7 天

Qwen3.8 Max (0902) 是 OrcaRouter 上由提供商 qwen 提供的一个模型条目,以模型 ID qwen/qwen3.8-max-0902 发布。列表中标有 0902,但所提供的事实并未说明它代表发布日期、检查点还是修订标签。这是一个长上下文多模态模型:它接受文本、图像和视频作为输入,具有 1,000,000 个 token 的上下文窗口,最多可生成 131,072…

什么是 Qwen3.8 Max (0902)?

这个模型的目标用户是谁?

这个模型接受哪些输入类型?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-0902",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

价格

输入 / 1M tokens$2.00
输出 / 1M tokens$6.00
缓存读取 / 1M$0.250
缓存写入 / 1M$2.50
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $32.00 · 启用提示缓存后 $25.88

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.003012

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
1.80 s
输出速度
89.0 tok/s
p95 首字节
2.80 s
错误率
11.1%

公共基准测试

来源: Design Arena

社区热度

本周开发者的讨论

Hacker News3 次提及 · 近 7 天较上周增加 3

对比一览

Qwen3.8 Max (0902)Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
输入 $/百万$2.00$2.00$0.86$0.17
输出 $/百万$6.00$6.00$3.44$1.03
上下文1.0M1.0M262K33K
质量9/109/108/108/10
并排对比并排对比并排对比并排对比

常见问题

在OrcaRouter上,Qwen3.8 Max的费用是多少?
标价为每1,000,000个输入token $2.00、每1,000,000个输出token $6.00,按提供商费率计费,零加价。
模型支持的上下文窗口和最大输出是多少?
该模型支持100万token的上下文窗口,最大输出为131,072个token。来自文本、图像和视频的所有输入token均计入上下文窗口。
这个模型相较于小型纯文本模型的主要优势是什么?
所列出的优势是其1,000,000个token的上下文、131,072个token的输出上限,以及其文本、图像和视频输入模态。未提供任何基准测试或准确率数据。
这个模型在OrcaRouter上与其他模型相比如何?
提供的事实中不包含模型对模型的对比。请根据上下文窗口、最大输出、输入模态和价格进行比较。此列表显示每1,000,000个输入标记收费$2.00,每1,000,000个输出标记收费$6.00。
当我调用这个模型时,OrcaRouter 如何处理数据?
模型信息未说明数据保留或数据处理条款。发送敏感数据前,请查阅 OrcaRouter 的条款和隐私政策以及服务提供商的使用条款。
我如何通过OpenAI兼容的API调用这个模型?
使用基础 URL https://api.orcarouter.ai/v1 和模型 ID qwen/qwen3.8-max-0902。将总提示词控制在 1,000,000 tokens 以内,输出限制不超过 131,072 tokens。
这个模型能生成图像或视频吗?
事实中未列出任何输出模态。输入模态为文本、图像和视频。输出仅由 OpenAI 兼容聊天补全中的最大输出 token 限制来描述。
有缓存定价或批量定价吗?
模型事实中未提及任何相关内容。列表仅说明每1,000,000个输入令牌收费$2.00,每1,000,000个输出令牌收费$6.00,按提供商费率计费,零加价。

嵌入此徽章

Qwen: Qwen3.8 Max (0902)$2.00/M in1800ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg" alt="Qwen: Qwen3.8 Max (0902) 在 OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max (0902)](https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902)

以数据形式获取模型卡

GET /api/public/models/qwen/qwen3.8-max-0902打开