Qwen3.8 Max

qwen/qwen3.8-max
NeuEmpfohlen
VisionToolsJSONReasoning
von Qwen · 2026-08-03

Qwen3.8-Max ist Alibabas neuestes Flaggschiff-Modell in der Qwen-Linie und seine leistungsfähigste Stufe bisher. Alibaba positioniert es direkt gegen GPT-5.5, Claude Opus 4.7 und Gemini 3.1 Pro in seinem eigenen Migrationsleitfaden und empfiehlt es immer dann, wenn eine Aufgabe die stärkste verfügbare Denkfähigkeit erfordert – komplexe mehrstufige Analysen, tiefe logische Ableitungen und anspruchsvolle Agentenarbeit. Es ist nativ multimodal und wird von Alibaba sowohl unter Textgenerierung als auch unter Bild-/Video-Verständnis gelistet: Es akzeptiert Text, Bilder und Videos und gibt Text zurück, mit einem Kontextfenster von 1 Million Token. Die offizielle Fähigkeitsmatrix bestätigt volle Unterstützung für Denkmodus, Funktionsaufrufe, integrierte Tools und strukturierte Ausgaben, was es zu einem vollwertigen Ersatz für Agent-Frameworks und Tool-Aufruf-Pipelines macht. Qwen3.8-Max wird über drei Wire-Formate bereitgestellt – OpenAI-kompatibel, Anthropic-kompatibel und nativ DashScope – in Peking, Singapur, Tokio, Frankfurt und Virginia. Das Denken wird über den Parameter enable_thinking (oder reasoning.effort in der Responses API) umgeschaltet. Es ist die Premium-Stufe der Familie: Greifen Sie darauf zu, wenn Korrektheit bei schwierigen Problemen die Kosten überwiegt, und wechseln Sie für den täglichen Bedarf zu Qwen3.7-Plus oder Qwen3.7-Flash.

Ktx1M Tokens
Eingabetext + image + video
Ausgabetext
p50 TTFT4.48 s
EINGABE$2.00/ 1M Tokens
AUSGABE$6.00/ 1M Tokens
p50 TTFT4.48 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR29.0MTokens / 7 T

Qwen3.8 Max ist ein multimodales Large Language Model aus der Qwen-Familie, verfügbar über OrcaRouter mit der Modell-ID 'qwen/qwen3.8-max'. Der Anbieter ist qwen. Es verfügt über ein Kontextfenster…

Was ist Qwen3.8 Max?

Für wen ist Qwen3.8 Max entwickelt?

Welche Eingabemodalitäten unterstützt Qwen3.8 Max?

Was bedeutet das 1.000.000-Token-Kontextfenster?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preise

Eingabe / 1M Tokens$2.00
Ausgabe / 1M Tokens$6.00
Cache-Lesen / 1M$0.250
Cache-Schreiben / 1M$2.50
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $32.00 · Mit Prompt-Caching $25.88

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.003054

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
4.48 s
Ausgabegeschwindigkeit
54.1 tok/s
p95 TTFT
10.00 s
Fehlerquote
0.24%

Öffentliche Benchmarks

Quelle: Design Arena

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News4 Erwähnungen · 7 T4 mehr als in der Vorwoche

Im Vergleich

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Eingabe $/M$2.00$0.86$0.17$0.12
Ausgabe $/M$6.00$3.44$1.03$0.69
Kontext1.0M262K33K1.0M
Qualität9/108/108/108/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet Qwen3.8 Max?
$2.00 pro 1M Eingabe-Tokens und $6.00 pro 1M Ausgabe-Tokens, abgerechnet zum qwen-Anbieterpreis ohne Aufschlag auf OrcaRouter.
Was ist das Kontextfenster von Qwen3.8 Max?
1.000.000 Token. Die Eingabe kann Text-, Bild- und Videoinhalte bis zu diesem Token-Limit umfassen.
Was sind die Stärken von Qwen3.8 Max?
Die Hauptstärken sind der 1.000.000-Token-Kontext und die Unterstützung für Text-, Bild- und Videoeingabe. Es werden keine Benchmark-Ergebnisse aufgelistet, daher sollten Sie die Qualität anhand Ihrer eigenen Aufgaben überprüfen.
Wie schneidet Qwen3.8 Max im Vergleich zu anderen Modellen ab?
Es verfügt über ein größeres Kontextfenster und multimodale Eingabe im Vergleich zu vielen kleineren oder reinen Textmodellen, hat aber auch einen höheren Token-Preis. Ohne Benchmark-Ergebnisse vergleiche, indem du es auf OrcaRouter testest.
Wie verarbeitet OrcaRouter Daten, die an Qwen3.8 Max gesendet werden?
Der Katalogeintrag beschreibt die Datenverarbeitung nicht. Überprüfen Sie die Datenschutzrichtlinie von OrcaRouter und die Bedingungen des qwen-Anbieters, bevor Sie sensible Daten senden.
Wie rufe ich Qwen3.8 Max über eine OpenAI-kompatible API auf?
Setzen Sie die Basis-URL auf https://api.orcarouter.ai/v1 und die Modell-ID auf 'qwen/qwen3.8-max', und senden Sie dann eine Chat-Completions-Anfrage mit Ihrem OrcaRouter-API-Schlüssel.
Kann Qwen3.8 Max Videos verarbeiten?
Ja, Video ist als Eingabemodalität aufgeführt, zusammen mit Text und Bild. Das genaue Schema für Video ist im Katalogeintrag nicht angegeben, testen Sie daher mit OrcaRouter.
Ist Eingabe-Caching für Qwen3.8 Max verfügbar?
Caching ist für dieses Modell nicht aufgeführt. Gehen Sie davon aus, dass Eingabe-Token mit 2,00 $ pro 1 Million Token abgerechnet werden. Prüfen Sie die API-Nutzungsmetadaten auf zwischengespeicherte Token, falls der Anbieter dies unterstützt.

Dieses Abzeichen einbetten

Qwen: Qwen3.8 Max$2.00/M in4476ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max auf OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

Modellkarte als Daten

GET /api/public/models/qwen/qwen3.8-maxÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt