Qwen3.8 Max

qwen/qwen3.8-max
精選
視覺工具JSON推理
來自 Qwen · 2026-08-03

Qwen3.8-Max 是阿里巴巴 Qwen 系列中最新旗艦模型,也是迄今為止能力等級最高的產品。阿里巴巴在其官方遷移指南中,將它直接定位為 GPT-5.5、Claude Opus 4.7 與 Gemini 3.1 Pro 的競爭對手,並建議在任務需要最強推理能力時採用——例如複雜的多步驟分析、深度邏輯推導,以及高要求的代理型(agentic)工作。 它原生支援多模態,阿里巴巴同時將它列入文字生成與影像/影片理解類別:可接受文字、圖片與影片輸入,並回傳文字,配備 1M-token 的上下文視窗。官方能力矩陣確認它完整支援思考模式、函式呼叫、內建工具與結構化輸出,可直接無縫嵌入代理框架與工具呼叫管線。 Qwen3.8-Max 透過三種線路格式提供服務——OpenAI 相容、Anthropic 相容,以及原生 DashScope——部署於北京、新加坡、東京、法蘭克福與維吉尼亞。思考模式可透過 enable_thinking 參數切換(或在 Responses API 上使用 reasoning.effort)。它是該系列的高階等級:當困難問題的正確性重於成本時使用它,日常處理大量工作時則可降級至 Qwen3.7-Plus 或 Qwen3.7-Flash。

上下文1M tokens
輸入模態text + image + video
輸出模態text
p50 首字節5.14 s
輸入$2.00/ 百萬 tokens
輸出$6.00/ 百萬 tokens
p50 首字節5.14 s7 天
p95 首字節10.00 s7 天
流量56.8Mtokens / 7 天

Qwen3.8 Max 是 Qwen 系列中的多模態大型語言模型,可透過 OrcaRouter 使用,模型 ID 為「qwen/qwen3.8-max」。提供方為 qwen。它的上下文視窗為 1,000,000 個 token,因此單一請求最多可包含一百萬個 token…

什麼是 Qwen3.8 Max?

Qwen3.8 Max 是為誰設計的?

Qwen3.8 Max 支援哪些輸入模態?

1,000,000 token 的上下文窗口是什麼意思?

程式碼範例

用任意 SDK 呼叫

相容 OpenAI——沿用你現有的 SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

支援的參數

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

價格

輸入 / 1M tokens$2.00
輸出 / 1M tokens$6.00
快取讀取 / 1M$0.250
快取寫入 / 1M$2.50
貨幣USD

費用計算器

每月 token 數10MM
輸入占比70%%
預計每月 $32.00 · 啟用提示快取後 $25.88

基於標價的估算

Token 與費用估算器

輸入 Token: 6每次請求費用: $0.003012

僅為估算——實際 Token 數取決於供應商的分詞器。

效能

p50 首字節
5.14 s
輸出速度
53.7 tok/s
p95 首字節
10.00 s
錯誤率
0.17%

公開基準測試

來源: Design Arena

社群熱度

本週開發者的討論

Hacker News4 次提及 · 近 7 天較上週增加 4

比較一覽

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
輸入 $/百萬$2.00$0.86$0.17$0.12
輸出 $/百萬$6.00$3.44$1.03$0.69
上下文1.0M262K33K1.0M
品質9/108/108/108/10
並排比較並排比較並排比較並排比較

常見問題

Qwen3.8 Max 要多少錢?
每100萬輸入tokens收費$2.00,每100萬輸出tokens收費$6.00,以qwen供應商費率計費,在OrcaRouter上零加價。
Qwen3.8 Max 的上下文視窗是多少?
1,000,000 個 token。輸入可包含文字、圖片和影片內容,最多可達該 token 限制。
Qwen3.8 Max 的優勢是什麼?
主要優勢在於 1,000,000-token 的上下文,以及支援文字、圖片和影片輸入。沒有列出基準測試分數,因此請在您自己的任務上驗證品質。
Qwen3.8 Max 與其他模型相比如何?
與許多較小或僅文字的模型相比,它擁有更大的上下文窗口和多模態輸入,但它的 token 價格也更高。在沒有基準測試分數的情況下,可以透過在 OrcaRouter 上測試來進行比較。
OrcaRouter 如何處理發送給 Qwen3.8 Max 的資料?
該目錄條目未描述資料處理方式。在傳送敏感資料前,請查閱 OrcaRouter 的隱私權政策及 qwen 提供者的條款。
我該如何透過 OpenAI 相容的 API 呼叫 Qwen3.8 Max?
將基礎 URL 設為 https://api.orcarouter.ai/v1,將模型 ID 設為 'qwen/qwen3.8-max',然後使用您的 OrcaRouter API 金鑰傳送聊天完成請求。
Qwen3.8 Max 可以處理影片嗎?
是的,影片被列為輸入模態之一,與文字和圖像並列。目錄條目中並未指定影片的確切結構描述,因此請使用 OrcaRouter 進行測試。
Qwen3.8 Max 是否支援輸入快取?
此模型未列出快取。假設輸入 Token 以每 1M Token 2.00 美元的費率計費。若供應商支援,請檢查 API 使用量中繼資料中的快取 Token。

嵌入此徽章

Qwen: Qwen3.8 Max$2.00/M in5142ms p50透過 OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max 於 OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

以資料形式取得模型卡

GET /api/public/models/qwen/qwen3.8-max開啟