Qwen3.8 Max

qwen/qwen3.8-max
NouveauEn vedette
VisionOutilsJSONRaisonnement
par Qwen · 2026-08-03

Qwen3.8-Max est le nouveau modèle phare d'Alibaba dans la gamme Qwen et son niveau de capacité le plus élevé à ce jour. Alibaba le positionne directement contre GPT-5.5, Claude Opus 4.7 et Gemini 3.1 Pro dans son propre guide de migration, le recommandant chaque fois qu'une tâche nécessite le raisonnement le plus fort disponible — analyse complexe en plusieurs étapes, dérivation logique approfondie et travail d'agent exigeant. Il est nativement multimodal, répertorié par Alibaba à la fois pour la génération de texte et la compréhension d'images/vidéos : il accepte du texte, des images et des vidéos et renvoie du texte, avec une fenêtre de contexte de 1 million de jetons. La matrice de capacités officielle confirme une prise en charge complète du mode de raisonnement, de l'appel de fonction, des outils intégrés et des sorties structurées, ce qui en fait un remplacement direct pour les frameworks d'agents et les pipelines d'appel d'outils. Qwen3.8-Max est servi via trois formats de transmission — compatible OpenAI, compatible Anthropic et DashScope natif — à Pékin, Singapour, Tokyo, Francfort et en Virginie. Le raisonnement est activé/désactivé avec le paramètre enable_thinking (ou reasoning.effort sur l'API Responses). C'est le niveau premium de la famille : choisissez-le lorsque la précision sur des problèmes difficiles prime sur le coût, et passez à Qwen3.7-Plus ou Qwen3.7-Flash pour le volume quotidien.

ctx1M tokens
Entréetext + image + video
Sortietext
p50 TTFT5.03 s
ENTRÉE$2.00/ 1M tokens
SORTIE$6.00/ 1M tokens
p50 TTFT5.03 s7 j
TTFT p9510.00 s7 j
TRAFIC52.8Mtokens / 7 j

Qwen3.8 Max est un modèle de langage multimodal de grande taille de la famille Qwen, disponible via OrcaRouter avec l'identifiant de modèle « qwen/qwen3.8-max ». Le fournisseur est qwen. Il dispose…

Qu'est-ce que Qwen3.8 Max ?

Pour qui est conçu Qwen3.8 Max ?

Quelles modalités d'entrée Qwen3.8 Max prend-il en charge ?

Que signifie la fenêtre de contexte de 1,000,000 de tokens ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$2.00
Sortie / 1M tokens$6.00
Lecture cache / 1M$0.250
Écriture cache / 1M$2.50
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $32.00 · Avec cache de prompt $25.88

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.003034

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
5.03 s
Vitesse de sortie
53.7 tok/s
TTFT p95
10.00 s
Taux d'erreur
0.17%

Benchmarks publics

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News4 mentions · 7 jen hausse de 4 vs la semaine précédente

Comparatif

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Entrée $/M$2.00$0.86$0.17$0.12
Sortie $/M$6.00$3.44$1.03$0.69
Contexte1.0M262K33K1.0M
Qualité9/108/108/108/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Qwen3.8 Max ?
$2.00 par 1M de jetons d'entrée et $6.00 par 1M de jetons de sortie, facturés au tarif du fournisseur qwen, sans aucune marge sur OrcaRouter.
Quelle est la fenêtre de contexte de Qwen3.8 Max ?
1,000,000 tokens. L'entrée peut inclure du texte, des images et du contenu vidéo jusqu'à cette limite de tokens.
Quels sont les points forts de Qwen3.8 Max ?
Les principaux atouts sont le contexte de 1,000,000 de jetons et la prise en charge des entrées texte, image et vidéo. Aucun score de référence n'est indiqué, vérifiez donc la qualité sur vos propres tâches.
Comment Qwen3.8 Max se compare-t-il aux autres modèles ?
Il dispose d'une fenêtre de contexte plus large et d'une entrée multimodale par rapport à de nombreux modèles plus petits ou purement textuels, mais il a également un prix de tokens plus élevé. Sans scores de référence, comparez en testant sur OrcaRouter.
Comment OrcaRouter gère-t-il les données envoyées à Qwen3.8 Max ?
L'entrée du catalogue ne décrit pas le traitement des données. Consultez la politique de confidentialité d'OrcaRouter et les conditions du fournisseur qwen avant d'envoyer des données sensibles.
Comment puis-je appeler Qwen3.8 Max via une API compatible OpenAI ?
Définissez l'URL de base sur https://api.orcarouter.ai/v1 et l'ID du modèle sur 'qwen/qwen3.8-max', puis envoyez une requête de chat completions avec votre clé API OrcaRouter.
Qwen3.8 Max peut-il traiter des vidéos ?
Oui, la vidéo est répertoriée comme modalité d'entrée, avec le texte et l'image. Le schéma exact de la vidéo n'est pas spécifié dans l'entrée du catalogue, donc testez avec OrcaRouter.
Le cache d'entrée est-il disponible pour Qwen3.8 Max ?
La mise en cache n'est pas répertoriée pour ce modèle. Supposons que les jetons d'entrée soient facturés à 2,00 $ par million de jetons. Vérifiez les métadonnées d'utilisation de l'API pour les jetons en cache si le fournisseur le prend en charge.

Intégrer ce badge

Qwen: Qwen3.8 Max$2.00/M in5029ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="Qwen: Qwen3.8 Max sur OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

Fiche du modèle en données

GET /api/public/models/qwen/qwen3.8-maxOuvrir
Lisible par machine:/llms.txt/llms-full.txt