Qwen3.8 Max (0902)

qwen/qwen3.8-max-0902
Nouveau
VisionOutilsJSONRaisonnement
par Qwen · 2026-09-02

Instantané daté du 2 septembre 2026 de Qwen3.8 Max, le modèle de raisonnement multimodal phare d'Alibaba : texte, image et vidéo en entrée, texte en sortie, contexte de 1 M de tokens. Mêmes capacités et mêmes tarifs que le modèle de base ; épinglez-le pour un comportement reproductible.

Points de terminaison:/v1/chat/completions
ctx1M tokens
Sortie max131K
Entréetext + image + video
Sortietext
p50 TTFT1.80 s
ENTRÉE$2.00/ 1M tokens
SORTIE$6.00/ 1M tokens
p50 TTFT1.80 s7 j
TTFT p952.80 s7 j
TRAFIC9.7Ktokens / 7 j

Qwen3.8 Max (0902) est un modèle répertorié sur OrcaRouter, provenant du fournisseur qwen, publié sous l'identifiant qwen/qwen3.8-max-0902. La notation 0902 est affichée dans la liste, mais les…

Qu'est-ce que Qwen3.8 Max (0902) ?

À qui ce modèle est-il destiné ?

Quels types d'entrée ce modèle accepte-t-il ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-0902",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$2.00
Sortie / 1M tokens$6.00
Lecture cache / 1M$0.250
Écriture cache / 1M$2.50
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $32.00 · Avec cache de prompt $25.88

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.003034

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
1.80 s
Vitesse de sortie
89.0 tok/s
TTFT p95
2.80 s
Taux d'erreur
11.1%

Benchmarks publics

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News3 mentions · 7 jen hausse de 3 vs la semaine précédente

Comparatif

Qwen3.8 Max (0902)Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrée $/M$2.00$2.00$0.86$0.17
Sortie $/M$6.00$6.00$3.44$1.03
Contexte1.0M1.0M262K33K
Qualité9/109/108/108/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Qwen3.8 Max sur OrcaRouter ?
Le prix affiché est de 2,00 $ pour 1 000 000 de jetons d'entrée et de 6,00 $ pour 1 000 000 de jetons de sortie, facturé au tarif du fournisseur avec une marge nulle.
Quelle fenêtre de contexte et quelle sortie maximale le modèle prend-il en charge ?
Le modèle prend en charge une fenêtre de contexte de 1 000 000 de jetons et une sortie maximale de 131 072 jetons. Tous les jetons d'entrée provenant du texte, des images et des vidéos comptent dans la fenêtre de contexte.
Quels sont les principaux atouts de ce modèle par rapport à un petit modèle uniquement textuel ?
Les points forts mentionnés sont son contexte de 1 000 000 de tokens, sa limite de sortie de 131 072 tokens, et ses modalités d'entrée texte, image et vidéo. Aucun benchmark ni chiffre de précision n'est fourni.
Comment ce modèle se compare-t-il aux autres modèles sur OrcaRouter ?
Les faits fournis ne comportent pas de comparaison modèle à modèle. Comparez en termes de fenêtre de contexte, de sortie maximale, de modalités d’entrée et de prix. Cette liste indique 2,00 $ par 1 000 000 de jetons d’entrée et 6,00 $ par 1 000 000 de jetons de sortie.
Comment OrcaRouter gère-t-il les données lorsque j'appelle ce modèle ?
Les caractéristiques du modèle ne précisent pas les conditions de conservation ou de traitement des données. Consultez les conditions et la politique de confidentialité d'OrcaRouter ainsi que les conditions d'utilisation du fournisseur avant d'envoyer des données sensibles.
Comment puis-je appeler ce modèle via une API compatible OpenAI ?
Utilisez l'URL de base https://api.orcarouter.ai/v1 et l'ID de modèle qwen/qwen3.8-max-0902. Gardez le prompt total sous 1 000 000 de jetons et la limite de sortie à 131 072 jetons ou moins.
Ce modèle génère-t-il des images ou des vidéos ?
Aucune modalité de sortie n'est listée dans les faits. Les modalités d'entrée sont le texte, l'image et la vidéo. La sortie n'est décrite que par la limite maximale de jetons de sortie dans une complétion de chat compatible OpenAI.
Y a-t-il une tarification pour le cache ou une tarification en gros ?
Aucune mention n'est faite dans les informations du modèle. La liste indique uniquement 2,00 $ pour 1 000 000 de jetons d'entrée et 6,00 $ pour 1 000 000 de jetons de sortie, facturés au tarif du fournisseur sans aucune majoration.

Intégrer ce badge

Qwen: Qwen3.8 Max (0902)$2.00/M in1800ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg" alt="Qwen: Qwen3.8 Max (0902) sur OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.8 Max (0902)](https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902)

Fiche du modèle en données

GET /api/public/models/qwen/qwen3.8-max-0902Ouvrir
Lisible par machine:/llms.txt/llms-full.txt