Qwen3.8 27B

qwen/qwen3.8-27b
NeuEmpfohlen
VisionToolsJSONReasoning
von Qwen · 2026-08-13

Qwen3.8-27B ist Alibabas dichtes multimodales Open-Weight-Modell mit 27B Parametern, veröffentlicht unter Apache-2.0 und selbst gehostet auf OrcaRouters eigener Infrastruktur. Es akzeptiert Text, Bilder und Videos und gibt Text zurück, mit einem 256K-Token-Kontextfenster (262.144 Positionen), das auf der Qwen3.5-Architektur basiert – 64 Schichten, 5120 Hidden Size, mit einem dedizierten Vision-Turm. Trotz seiner 27B-Größe liefert es auf Qwens eigener Modellkarte ungewöhnlich starke agentische und Coding-Ergebnisse, darunter 90,3 bei LiveCodeBench v6, 89,2 bei GPQA Diamond, 84,3 bei OSWorld-Verified und 79,0 bei QwenSWEBench – in mehreren Bereichen konkurrenzfähig mit weitaus größeren geschlossenen Modellen. Es unterstützt natives Tool-Calling, strukturierte Ausgaben, den Reasoning-Modus und die vollständige Sampling-Oberfläche. Da die Gewichte offen sind und wir sie selbst betreiben, gibt es keine Anbieterkosten pro Token, die durchgereicht werden müssten. Das macht Qwen3.8-27B zu einer starken Standardwahl für multimodale Arbeiten mit hohem Volumen: Dokument- und Screenshot-Verständnis, Videobilder, Coding-Agenten und Automatisierung im Computer-Use-Stil.

Ktx262K Tokens
Eingabetext + image + video
Ausgabetext
p50 TTFT225 ms
EINGABE$0.33/ 1M Tokens
AUSGABE$2.40/ 1M Tokens
p50 TTFT225 ms7 T
p95 TTFT800 ms7 T
DATENVERKEHR2.3KTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-27b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_p

Preise

Eingabe / 1M Tokens$0.330
Ausgabe / 1M Tokens$2.40
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $9.51

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.001209

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
225 ms
Ausgabegeschwindigkeit
224 tok/s
p95 TTFT
800 ms
Fehlerquote
33.3%

Öffentliche Benchmarks

AndroidWorld
81.9
CharXiv (RQ)
78.8
CoWorkBench
70.7
DeepSWE 1.1
42.2
ERQA
65.5
GPQA Diamond
89.2
HLE
30.8
IFBench
79.5
JobBench
33.4
LiveCodeBench v6
90.3
NL2Repo-Bench
42.3
OmniDocBench 1.5
91.1
OSWorld-Verified
84.3
QwenSWEBench
79.0
RealWorldQA
85.9
RecreationBench
47.1
SWE-bench Pro
61.7
SWE-MM
38.6
Terminal Bench 2.1 (Terminus)
73.0
Vision2Web
62.9
WebArena-Verified
64.8
Quelle: huggingface.co/Qwen

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News11 Erwähnungen · 7 T10 mehr als in der Vorwoche

Im Vergleich

Qwen3.8 27BQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Eingabe $/M$0.33$2.00$0.86$0.17
Ausgabe $/M$2.40$6.00$3.44$1.03
Kontext262K1.0M262K33K
Qualität4/109/108/108/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet Qwen: Qwen3.8 27B auf OrcaRouter?
Qwen: Qwen3.8 27B kostet $0.33 pro 1M Eingabetokens und $2.40 pro 1M Ausgabetokens über OrcaRouter. Die Preise werden live von der Routing-Schicht abgerufen.
Was ist das Kontextfenster von Qwen: Qwen3.8 27B?
Qwen: Qwen3.8 27B unterstützt ein Kontextfenster von 262K Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich Qwen: Qwen3.8 27B über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="qwen/qwen3.8-27b" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter Qwen: Qwen3.8 27B?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

Qwen: Qwen3.8 27B$0.33/M in225ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-27b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-27b.svg" alt="Qwen: Qwen3.8 27B auf OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 27B](https://www.orcarouter.ai/embed/qwen/qwen3.8-27b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-27b)

Modellkarte als Daten

GET /api/public/models/qwen/qwen3.8-27bÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt