Qwen3.5-35B-A3B

qwen/qwen3.5-35b-a3b
VisãoFerramentasJSONRaciocínio
por Qwen · 2026-02-25

Qwen3.5 35B-A3B — MoE de peso aberto multimodal (texto/imagem/vídeo), 35B total / 3B parâmetros ativos, contexto de 32k (modo de visão).

ctx32K tokens
Saída máx.65K
Entradatext + image + video
Saídatext
p50 TTFT3.50 s
ENTRADA$0.06/ 1M tokens
SAÍDA$0.46/ 1M tokens
p50 TTFT3.50 s7 d
p95 TTFT8.56 s7 d
TRÁFEGO484.2Ktokens / 7 d

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preços

NívelEntrada / 1M tokensSaída / 1M tokens
128K$0.057$0.459
256K$0.229$1.835
Nível selecionado pela contagem de tokens de entrada de cada solicitação

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $1.78

Estimativa com base no preço de tabela

Preços por níveis — esta estimativa usa as tarifas do nível base.

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000230

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
3.50 s
Velocidade de saída
110 tok/s
p95 TTFT
8.56 s
Taxa de erro
0%

Benchmarks públicos

63.9
AA Coding
Melhor que 75% dos modelos comparados
nº 32 de 130
29.9
AA Intelligence
Melhor que 35% dos modelos comparados
nº 85 de 132
69.9
AA Math
Melhor que 61% dos modelos comparados
nº 32 de 82
GPQA Diamond
84.5
Humanity's Last Exam
21.0
IFBench
72.5
Long-Context Recall
68.3
MMLU-Pro
71.9 index
SciCode
37.7
TerminalBench Hard
26.5
τ²-Bench
89.2
Fonte: artificialanalysis.ai

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News0 menções · 7 d

Comparativo

Qwen3.5-35B-A3BQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Entrada $/M$0.06$2.00$0.86$0.17
Saída $/M$0.46$6.00$3.44$1.03
Contexto33K1.0M262K33K
Qualidade6/109/108/108/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa Qwen: Qwen3.5-35B-A3B no OrcaRouter?
Qwen: Qwen3.5-35B-A3B tem o preço de $0.06 por 1M tokens de entrada e $0.46 por 1M tokens de saída via OrcaRouter. Os preços são obtidos em tempo real da camada de roteamento.
Qual é a janela de contexto de Qwen: Qwen3.5-35B-A3B's?
Qwen: Qwen3.5-35B-A3B suporta uma janela de contexto de 33K tokens. Use recursos de contexto longo (RAG, sumarização) até esse limite.
Como chamar Qwen: Qwen3.5-35B-A3B via o SDK da OpenAI?
Defina o base_url do OpenAI como https://api.orcarouter.ai/v1, forneça sua chave de API do OrcaRouter e passe model="qwen/qwen3.5-35b-a3b" na chamada chat.completions.create.
O OrcaRouter limita a taxa de Qwen: Qwen3.5-35B-A3B?
Os limites de taxa por modelo seguem o seu plano OrcaRouter. Os planos gratuitos vêm com limites conservadores; os planos pagos os aumentam. Verifique /pricing para as cotas atuais.

Incorporar este selo

Qwen: Qwen3.5-35B-A3B$0.06/M in3500ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg" alt="Qwen: Qwen3.5-35B-A3B no OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.5-35B-A3B](https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b)

Ficha do modelo como dados

GET /api/public/models/qwen/qwen3.5-35b-a3bAbrir
Legível por máquina:/llms.txt/llms-full.txt