Qwen3.8 Max

qwen/qwen3.8-max
精选
视觉工具JSON推理
来自 Qwen · 2026-08-03

Qwen3.8-Max 是阿里巴巴 Qwen 系列中最新旗舰模型,也是迄今为止能力最强的产品层级。阿里巴巴在其自己的迁移指南中将其直接对标 GPT-5.5、Claude Opus 4.7 和 Gemini 3.1 Pro,并推荐在需要最强可用推理能力的任务中使用它——包括复杂的多步分析、深层逻辑推导和高要求的智能体工作。 它原生支持多模态,阿里巴巴将其同时列入文本生成和图像/视频理解类别:可接受文本、图像和视频输入,并返回文本,上下文窗口为 1M token。官方能力矩阵确认其完全支持思考模式、函数调用、内置工具和结构化输出,使其成为智能体框架和工具调用流程的无缝替代方案。 Qwen3.8-Max 通过三种接口格式提供服务——兼容 OpenAI、兼容 Anthropic 以及原生 DashScope——覆盖北京、新加坡、东京、法兰克福和弗吉尼亚。思考模式通过 enable_thinking 参数(或 Responses API 上的 reasoning.effort)切换。它是该系列中的高级层级:当在难题上的正确性比成本更重要时,请使用它;而对于日常大规模使用,可回退到 Qwen3.7-Plus 或 Qwen3.7-Flash。

上下文1M tokens
输入模态text + image + video
输出模态text
p50 首字节5.14 s
输入$2.00/ 百万 tokens
输出$6.00/ 百万 tokens
p50 首字节5.14 s7 天
p95 首字节10.00 s7 天
流量56.8Mtokens / 7 天

Qwen3.8 Max 是 Qwen 系列中的一款多模态大语言模型,可通过 OrcaRouter 以模型 ID 'qwen/qwen3.8-max' 使用。提供商为 qwen。其上下文窗口为 1,000,000 个 token,因此单个请求最多可包含一百万 token…

Qwen3.8 Max 是什么?

Qwen3.8 Max 是为谁设计的?

Qwen3.8 Max 支持哪些输入模态?

1,000,000-token的上下文窗口是什么意思?

代码示例

用任意 SDK 调用

兼容 OpenAI——沿用你现有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支持的参数

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

价格

输入 / 1M tokens$2.00
输出 / 1M tokens$6.00
缓存读取 / 1M$0.250
缓存写入 / 1M$2.50
货币USD

费用计算器

每月 token 数10MM
输入占比70%%
预计每月 $32.00 · 启用提示缓存后 $25.88

基于标价的估算

Token 与费用估算器

输入 Token: 6每次请求费用: $0.003012

仅为估算——实际 Token 数取决于提供商的分词器。

性能

p50 首字节
5.14 s
输出速度
53.7 tok/s
p95 首字节
10.00 s
错误率
0.17%

公共基准测试

来源: Design Arena

社区热度

本周开发者的讨论

Hacker News4 次提及 · 近 7 天较上周增加 4

对比一览

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
输入 $/百万$2.00$0.86$0.17$0.12
输出 $/百万$6.00$3.44$1.03$0.69
上下文1.0M262K33K1.0M
质量9/108/108/108/10
并排对比并排对比并排对比并排对比

常见问题

Qwen3.8 Max 多少钱?
每100万输入tokens收费$2.00,每100万输出tokens收费$6.00,按qwen提供商费率计费,OrcaRouter上零加价。
Qwen3.8 Max 的上下文窗口是多少?
1,000,000 tokens。输入可包含文本、图像和视频内容,总 token 数不超过该限制。
Qwen3.8 Max 的优势是什么?
主要优势是 1,000,000-token 的上下文窗口,以及对文本、图像和视频输入的支持。没有列出基准测试分数,因此请在自己的任务上验证质量。
Qwen3.8 Max与其他模型相比如何?
与许多较小或纯文本模型相比,它拥有更大的上下文窗口和多模态输入,但token价格也更高。在没有基准评分的情况下,可改为在OrcaRouter上测试进行比较。
OrcaRouter 如何处理发送到 Qwen3.8 Max 的数据?
该目录条目未说明数据处理方式。发送敏感数据前,请审阅OrcaRouter的隐私政策及qwen提供商的条款。
如何通过OpenAI兼容的API调用Qwen3.8 Max?
将基础 URL 设置为 https://api.orcarouter.ai/v1,模型 ID 设置为 'qwen/qwen3.8-max',然后使用你的 OrcaRouter API 密钥发送一个聊天补全请求。
Qwen3.8 Max能处理视频吗?
是的,视频与文本和图像一样被列为输入模态。目录条目中未指定视频的确切模式,因此请使用OrcaRouter进行测试。
Qwen3.8 Max 支持输入缓存吗?
此模型未列出缓存。假设输入 token 按每 100 万 token $2.00 计费。如果提供商支持,请检查 API 使用情况元数据中的缓存 token。

嵌入此徽章

Qwen: Qwen3.8 Max$2.00/M in5142ms p50通过 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max 在 OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

以数据形式获取模型卡

GET /api/public/models/qwen/qwen3.8-max打开