Qwen3.8 Max

qwen/qwen3.8-max
NyUtvalt
VisionVerktygJSONResonemang
av Qwen · 2026-08-03

Qwen3.8-Max är Alibabas senaste flaggskeppsmodell i Qwen-serien och dess högsta kapabilitetsnivå hittills. Alibaba positionerar den direkt mot GPT-5.5, Claude Opus 4.7 och Gemini 3.1 Pro i sin egen migrationsguide och rekommenderar den närhelst en uppgift kräver det starkaste tillgängliga resonemanget — komplex flerstegsanalys, djup logisk härledning och krävande agentarbete. Den är naturligt multimodal, listad av Alibaba under både textgenerering och bild/video-förståelse: den tar emot text, bilder och video och returnerar text, med ett kontextfönster på 1M-token. Den officiella kapabilitetsmatrisen bekräftar fullt stöd för tankeläge, funktionsanrop, inbyggda verktyg och strukturerade utdata, vilket gör den till en komplett drop-in för agentramverk och verktygsanrops-pipelines. Qwen3.8-Max levereras genom tre wire-format — OpenAI-kompatibelt, Anthropic-kompatibelt och native DashScope — över Beijing, Singapore, Tokyo, Frankfurt och Virginia. Tankeläge aktiveras med parametern enable_thinking (eller reasoning.effort på Responses API). Det är familjens premiumnivå: ta till den när korrekthet på svåra problem väger tyngre än kostnad, och gå ner till Qwen3.7-Plus eller Qwen3.7-Flash för vardagsvolymer.

ctx1M tokens
Inmatningtext + image + video
Utdatatext
p50 TTFT5.03 s
INMATNING$2.00/ 1M token
UTDATA$6.00/ 1M token
p50 TTFT5.03 s7d
p95 TTFT10.00 s7d
TRAFIK52.8Mtokens/7d

Qwen3.8 Max är en multimodal stor språkmodell från Qwen-familjen, tillgänglig via OrcaRouter med modell-ID:t 'qwen/qwen3.8-max'. Leverantören är qwen. Den har ett kontextfönster på 1 000 000 tokens,…

Vad är Qwen3.8 Max?

Vem är Qwen3.8 Max designad för?

Vilka inmatningsmodaliteter stöder Qwen3.8 Max?

Vad betyder 1,000,000-token kontextfönstret?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Priser

Inmatning / 1M token$2.00
Utdata / 1M tokens$6.00
Cacheläsning / 1M$0.250
Cache-skrivning / 1M$2.50
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $32.00 · Med promptcachning $25.88

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.003036

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
5.03 s
Utdatahastighet
53.7 tok/s
p95 TTFT
10.00 s
Felfrekvens
0.17%

Offentliga benchmarks

Källa: Design Arena

Community-buzz

Vad utvecklare säger den här veckan

Hacker News4 omnämnanden · 7dupp 4 jämfört med föregående vecka

Så jämför den sig

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$2.00$0.86$0.17$0.12
Output $/M$6.00$3.44$1.03$0.69
Kontext1.0M262K33K1.0M
Kvalitet9/108/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad kostar Qwen3.8 Max?
$2,00 per 1M inmatningstokens och $6,00 per 1M utmatningstokens, fakturerat enligt qwen-leverantörens taxa utan påslag på OrcaRouter.
Vad är kontextfönstret för Qwen3.8 Max?
1 000 000 tokens. Inmatningen kan innehålla text-, bild- och videoinnehåll upp till denna token-gräns.
Vad är styrkorna med Qwen3.8 Max?
De främsta styrkorna är kontexten på 1 000 000 token och stödet för text-, bild- och videoinmatning. Inga benchmarkresultat anges, så verifiera kvaliteten på dina egna uppgifter.
Hur jämför Qwen3.8 Max med andra modeller?
Den har ett större kontextfönster och multimodal inmatning jämfört med många mindre eller textbaserade modeller, men den har också ett högre tokenpris. Utan benchmark-poäng, jämför genom att testa på OrcaRouter.
Hur hanterar OrcaRouter data som skickas till Qwen3.8 Max?
Katalogposten beskriver inte datahantering. Granska OrcaRouters integritetspolicy och qwen-leverantörens villkor innan du skickar känsliga data.
Hur anropar jag Qwen3.8 Max via ett OpenAI-kompatibelt API?
Ställ in bas-URL:en till https://api.orcarouter.ai/v1 och modell-ID:t till 'qwen/qwen3.8-max', skicka sedan en chat completions-förfrågan med din OrcaRouter API-nyckel.
Kan Qwen3.8 Max bearbeta video?
Ja, video är listat som en inmatningsmodalitet, tillsammans med text och bild. Det exakta schemat för video är inte specificerat i katalogposten, så testa med OrcaRouter.
Är input-cache tillgängligt för Qwen3.8 Max?
Cachning är inte listad för denna modell. Anta att inmatningstokens debiteras till $2,00 per 1M tokens. Kontrollera API-användningsmetadata för cachade tokens om leverantören stödjer det.

Bädda in denna badge

Qwen: Qwen3.8 Max$2.00/M in5029ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

Modellkort som data

GET /api/public/models/qwen/qwen3.8-maxÖppna