Qwen3.5-35B-A3B

qwen/qwen3.5-35b-a3b
VisionOutilsJSONRaisonnement
par Qwen · 2026-02-25

Qwen3.5 35B-A3B — open-weight MoE multimodal (texte/image/vidéo), 35B total / 3B paramètres actifs, contexte de 32k (mode vision).

Points de terminaison:/v1/chat/completions
ctx32K tokens
Sortie max65K
Entréetext + image + video
Sortietext
p50 TTFT3.88 s
ENTRÉE$0.06/ 1M tokens
SORTIE$0.46/ 1M tokens
p50 TTFT3.88 s7 j
TTFT p9510.00 s7 j
TRAFIC388.0Ktokens / 7 j

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Tarifs

PalierEntrée / 1M tokensSortie / 1M tokens
128K$0.057$0.459
256K$0.229$1.835
Palier sélectionné selon le nombre de tokens d'entrée de chaque requête

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $1.78

Estimation basée sur le tarif public

Tarification par paliers — cette estimation utilise les tarifs du palier de base.

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000230

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
3.88 s
Vitesse de sortie
142 tok/s
TTFT p95
10.00 s
Taux d'erreur
0%

Benchmarks publics

63.9
AA Coding
Meilleur que 76 % des modèles comparés
n°31 sur 128
29.9
AA Intelligence
Meilleur que 35 % des modèles comparés
n°84 sur 130
69.9
AA Math
Meilleur que 62 % des modèles comparés
n°31 sur 81
GPQA Diamond
84.5
Humanity's Last Exam
21.0
IFBench
72.5
Long-Context Recall
68.3
MMLU-Pro
71.9 index
SciCode
37.7
TerminalBench Hard
26.5
τ²-Bench
89.2
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News0 mentions · 7 j

Comparatif

Qwen3.5-35B-A3BQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrée $/M$0.06$2.00$0.86$0.17
Sortie $/M$0.46$6.00$3.44$1.03
Contexte33K1.0M262K33K
Qualité6/109/108/108/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Qwen: Qwen3.5-35B-A3B sur OrcaRouter ?
Qwen: Qwen3.5-35B-A3B est facturé à $0.06 par 1M tokens d'entrée et $0.46 par 1M tokens de sortie via OrcaRouter. La tarification est extraite en direct de la couche de routage.
Quelle est la fenêtre de contexte de Qwen: Qwen3.5-35B-A3B ?
Qwen: Qwen3.5-35B-A3B prend en charge une fenêtre de contexte de 33K tokens. Utilisez les fonctionnalités de contexte long (RAG, résumé) jusqu’à cette limite.
Comment appeler Qwen: Qwen3.5-35B-A3B via le SDK OpenAI ?
Définissez base_url d'OpenAI sur https://api.orcarouter.ai/v1, fournissez votre clé API OrcaRouter et passez model="qwen/qwen3.5-35b-a3b" dans l'appel chat.completions.create.
OrcaRouter limite-t-il le débit de Qwen: Qwen3.5-35B-A3B ?
Les limites de débit par modèle suivent votre forfait OrcaRouter. Les offres gratuites sont assorties de plafonds conservateurs ; les offres payantes les relèvent. Consultez /pricing pour connaître les quotas actuels.

Intégrer ce badge

Qwen: Qwen3.5-35B-A3B$0.06/M in3875ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg" alt="Qwen: Qwen3.5-35B-A3B sur OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.5-35B-A3B](https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b)

Fiche du modèle en données

GET /api/public/models/qwen/qwen3.5-35b-a3bOuvrir
Lisible par machine:/llms.txt/llms-full.txt