qwen/qwen3-max-preview

qwen/qwen3-max-preview
ToolsJSONReasoning
von qwen

Qwen3 Max preview — proprietäre Chat-Vorschau, 256k Kontext, Denkmodus + Funktionsaufruf

Ktx262K Tokens
Max. Ausgabe65K
Eingabetext
Ausgabetext
p50 TTFT10.00 s
EINGABE$0.86/ 1M Tokens
AUSGABE$3.44/ 1M Tokens
p50 TTFT10.00 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR1.2MTokens / 7 T

Qwen3-Max-Preview ist ein reines Text-Large-Language-Modell aus der Qwen-Familie, entwickelt vom Qwen-Team von Alibaba Cloud. Es ist derzeit als Preview verfügbar, was einen frühen Zugang zu neuen…

Was ist Qwen3-Max-Preview?

Wer sollte dieses Modell verwenden?

Was macht es einzigartig?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-max-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preise

StufeEingabe / 1M TokensAusgabe / 1M Tokens
32K$0.861$3.441
128K$1.434$5.735
256K$2.151$8.602
Stufe wird durch die Eingabe-Token-Anzahl jeder Anfrage bestimmt

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $16.35

Schätzung auf Basis des Listenpreises

Gestaffelte Preise — diese Schätzung verwendet die Basisstufe.

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.001744

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
10.00 s
Ausgabegeschwindigkeit
75.1 tok/s
p95 TTFT
10.00 s
Fehlerquote
24.1%

Öffentliche Benchmarks

25.5
AA Coding
Besser als 24 % der verglichenen Modelle
Nr. 104 von 137
19.4
AA Intelligence
Besser als 17 % der verglichenen Modelle
Nr. 116 von 139
75.0
AA Math
Besser als 68 % der verglichenen Modelle
Nr. 26 von 82
AIME 2025
75.0
GPQA Diamond
76.4
Humanity's Last Exam
10.1
IFBench
48.0
LiveCodeBench
65.1
Long-Context Recall
42.3
MMLU-Pro
83.8
SciCode
37.0
TerminalBench Hard
19.7
τ²-Bench
32.7
Quelle: artificialanalysis.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News1 Erwähnungen · 7 T1 mehr als in der Vorwoche

Im Vergleich

qwen/qwen3-max-previewQwen3.8 MaxQwen3.8 Max (0902)Qwen3.5 397B A17B
Eingabe $/M$0.86$2.00$2.00$0.17
Ausgabe $/M$3.44$6.00$6.00$1.03
Kontext262K1.0M1.0M33K
Qualität8/109/109/108/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet es, qwen/qwen3-max-preview auf OrcaRouter zu verwenden?
Spezifische Preise pro Token für dieses Modell sind in den verfügbaren Fakten nicht angegeben. Bitte besuchen Sie die Preisseite von OrcaRouter oder kontaktieren Sie deren Vertriebsteam für aktuelle Tarife.
Wie groß ist das Kontextfenster von Qwen3-Max-Preview?
Das Modell unterstützt ein Kontextfenster von 262.144 Token.
Was ist die maximale Ausgabelänge?
Das Modell kann in einer einzigen Antwort bis zu 65.536 Token generieren.
Was sind die Hauptstärken des Modells?
Es kombiniert ein extrem großes Kontextfenster (262K Token) mit einer hohen MMLU-Pro-Bewertung (83,8) und einer großen Ausgabebegrenzung, was es stark für die Analyse langer Dokumente und komplexes Denken macht.
Wie schneidet dieses Modell im Vergleich zu anderen Qwen-Modellen ab?
Qwen3-Max-Preview ist eine Vorschau mit einem größeren Kontextfenster als die vorherigen Qwen2.5-Modelle. Sie repräsentiert die neuesten Verbesserungen, könnte aber weniger stabil sein.
Unterstützt das Modell Bild- oder Audioeingaben?
Nein, es ist nur Text. Es akzeptiert nur Texteingabe und erzeugt Textausgabe.
Wie rufe ich dieses Modell mit einer OpenAI-kompatiblen API auf?
Verwenden Sie die OrcaRouter-API unter https://api.orcarouter.ai/v1 mit der Modell-ID 'qwen/qwen3-max-preview'. Die API unterstützt die standardmäßigen OpenAI Chat Completion Parameter.
Welche Datenverarbeitungsrichtlinien gelten?
Die Datenverarbeitung erfolgt gemäß den Nutzungsbedingungen und der Datenschutzrichtlinie von OrcaRouter. Die bereitgestellten Fakten enthalten keine spezifischen Angaben zur Datenspeicherung oder -verarbeitung; konsultieren Sie die Dokumentation von OrcaRouter.
Ist dieses Modell für den Produktionseinsatz geeignet?
Es ist eine Vorabversion, die möglicherweise weniger stabil ist als eine Produktionsversion. Testen Sie es mit Ihrem spezifischen Workload, bevor Sie es in der Produktion einsetzen.
Welche Benchmarks sind verfügbar?
Nur der MMLU-Pro-Wert von 83.8 wird angegeben. Keine anderen Benchmark-Ergebnisse sind Teil der verfügbaren Fakten.

Dieses Abzeichen einbetten

qwen/qwen3-max-preview$0.86/M in10000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-max-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-max-preview.svg" alt="qwen/qwen3-max-preview auf OrcaRouter" /> </a>
Markdown [![qwen/qwen3-max-preview](https://www.orcarouter.ai/embed/qwen/qwen3-max-preview.svg)](https://www.orcarouter.ai/models/qwen/qwen3-max-preview)

Modellkarte als Daten

GET /api/public/models/qwen/qwen3-max-previewÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt