Qwen3.8 27B

qwen/qwen3.8-27b
NouveauEn vedette
VisionOutilsJSONRaisonnement
par Qwen · 2026-08-13

Qwen3.8-27B est le modèle multimodal dense de 27B à poids ouverts d'Alibaba, publié sous licence Apache-2.0 et auto-hébergé sur l'infrastructure propre d'OrcaRouter. Il accepte le texte, les images et la vidéo et renvoie du texte, avec une fenêtre de contexte de 256K jetons (262 144 positions) construite sur l'architecture Qwen3.5 - 64 couches, taille cachée de 5120, avec une tour de vision dédiée. Malgré sa taille de 27B, il affiche des résultats d'agents et de codage exceptionnellement solides sur la propre fiche modèle de Qwen, notamment 90.3 sur LiveCodeBench v6, 89.2 sur GPQA Diamond, 84.3 sur OSWorld-Verified et 79.0 sur QwenSWEBench - compétitif avec des modèles fermés beaucoup plus grands sur plusieurs axes. Il prend en charge l'appel d'outils natif, les sorties structurées, le mode raisonnement et la surface d'échantillonnage complète. Parce que les poids sont ouverts et que nous les exécutons nous-mêmes, il n'y a aucun coût fournisseur par jeton à répercuter. Cela fait de Qwen3.8-27B un choix par défaut solide pour les travaux multimodaux à volume élevé : compréhension de documents et de captures d'écran, images vidéo, agents de codage et automatisation de type utilisation d'ordinateur.

Points de terminaison:/v1/chat/completions/v1/responses
ctx262K tokens
Entréetext + image + video
Sortietext
p50 TTFT225 ms
ENTRÉE$0.33/ 1M tokens
SORTIE$2.40/ 1M tokens
p50 TTFT225 ms7 j
TTFT p95800 ms7 j
TRAFIC2.3Ktokens / 7 j

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-27b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_p

Tarifs

Entrée / 1M tokens$0.330
Sortie / 1M tokens$2.40
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $9.51

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.001206

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
225 ms
Vitesse de sortie
224 tok/s
TTFT p95
800 ms
Taux d'erreur
33.3%

Benchmarks publics

AndroidWorld
81.9
CharXiv (RQ)
78.8
CoWorkBench
70.7
DeepSWE 1.1
42.2
ERQA
65.5
GPQA Diamond
89.2
HLE
30.8
IFBench
79.5
JobBench
33.4
LiveCodeBench v6
90.3
NL2Repo-Bench
42.3
OmniDocBench 1.5
91.1
OSWorld-Verified
84.3
QwenSWEBench
79.0
RealWorldQA
85.9
RecreationBench
47.1
SWE-bench Pro
61.7
SWE-MM
38.6
Terminal Bench 2.1 (Terminus)
73.0
Vision2Web
62.9
WebArena-Verified
64.8
Source: huggingface.co/Qwen

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News11 mentions · 7 jen hausse de 10 vs la semaine précédente

Comparatif

Qwen3.8 27BQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrée $/M$0.33$2.00$0.86$0.17
Sortie $/M$2.40$6.00$3.44$1.03
Contexte262K1.0M262K33K
Qualité4/109/108/108/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Qwen: Qwen3.8 27B sur OrcaRouter ?
Qwen: Qwen3.8 27B est facturé à $0.33 par 1M tokens d'entrée et $2.40 par 1M tokens de sortie via OrcaRouter. La tarification est extraite en direct de la couche de routage.
Quelle est la fenêtre de contexte de Qwen: Qwen3.8 27B ?
Qwen: Qwen3.8 27B prend en charge une fenêtre de contexte de 262K tokens. Utilisez les fonctionnalités de contexte long (RAG, résumé) jusqu’à cette limite.
Comment appeler Qwen: Qwen3.8 27B via le SDK OpenAI ?
Définissez base_url d'OpenAI sur https://api.orcarouter.ai/v1, fournissez votre clé API OrcaRouter et passez model="qwen/qwen3.8-27b" dans l'appel chat.completions.create.
OrcaRouter limite-t-il le débit de Qwen: Qwen3.8 27B ?
Les limites de débit par modèle suivent votre forfait OrcaRouter. Les offres gratuites sont assorties de plafonds conservateurs ; les offres payantes les relèvent. Consultez /pricing pour connaître les quotas actuels.

Intégrer ce badge

Qwen: Qwen3.8 27B$0.33/M in225ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-27b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-27b.svg" alt="Qwen: Qwen3.8 27B sur OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 27B](https://www.orcarouter.ai/embed/qwen/qwen3.8-27b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-27b)

Fiche du modèle en données

GET /api/public/models/qwen/qwen3.8-27bOuvrir
Lisible par machine:/llms.txt/llms-full.txt