Qwen3.5-35B-A3B

qwen/qwen3.5-35b-a3b
VisionVerktygJSONResonemang
av Qwen · 2026-02-25

Qwen3.5 35B-A3B — öppen-vikt MoE multimodal (text/bild/video), 35B totalt / 3B aktiva parametrar, 32k kontext (synläge).

ctx32.8K tokens
Max output65.5K
Inmatningtext + image + video
Utdatatext
p50 TTFT3.75 s
INMATNING$0.06/ 1M token
UTDATA$0.46/ 1M token
p50 TTFT3.75 s7d
p95 TTFT10.00 s7d
TRAFIK206.3Mtokens/7d

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Priser

NivåInmatning / 1M tokenUtdata / 1M tokens
128K$0.057$0.459
256K$0.229$1.835
Nivå väljs utifrån antalet inmatningstoken per förfrågan

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $1.78

Uppskattning baserad på listpris

Skiktad prissättning — den här uppskattningen använder priser för basnivån.

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.000231

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
3.75 s
Utdatahastighet
148 tok/s
p95 TTFT
10.00 s
Felfrekvens
5.6%

Offentliga benchmarks

63.9
AA Coding
Bättre än 80% av jämförda modeller
#24 av 123
29.3
AA Intelligence
Bättre än 35% av jämförda modeller
#80 av 125
69.9
AA Math
Bättre än 62% av jämförda modeller
#31 av 81
GPQA Diamond
84.5
Humanity's Last Exam
19.7
IFBench
72.5
Long-Context Recall
62.7
MMLU-Pro
71.9 index
SciCode
37.7
TerminalBench Hard
26.5
τ²-Bench
89.2
Källa: artificialanalysis.ai

Så jämför den sig

Qwen3.5-35B-A3Bqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Input $/M$0.06$0.86$0.17$0.12
Output $/M$0.46$3.44$1.03$0.69
Kontext33K262K33K1.0M
Kvalitet6/108/108/108/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Hur mycket kostar Qwen: Qwen3.5-35B-A3B på OrcaRouter?
Qwen: Qwen3.5-35B-A3B prissätts till $0.06 per 1M inmatningstokens och $0.46 per 1M utmatningstokens via OrcaRouter. Prissättningen hämtas live från routningslagret.
Vad är Qwen: Qwen3.5-35B-A3B:s kontextfönster?
Qwen: Qwen3.5-35B-A3B stöder ett kontextfönster på 33K tokens. Använd långkontext-funktioner (RAG, sammanfattning) upp till den gränsen.
Hur anropar jag Qwen: Qwen3.5-35B-A3B via OpenAI SDK?
Ställ in OpenAI base_url till https://api.orcarouter.ai/v1, ange din OrcaRouter API-nyckel, och skicka model="qwen/qwen3.5-35b-a3b" i anropet till chat.completions.create.
Begränsar OrcaRouter hastigheten för Qwen: Qwen3.5-35B-A3B?
Per-modell hastighetsbegränsningar följer din OrcaRouter-plan. Gratisnivåer levereras med konservativa gränser; betalnivåer lyfter dem. Kolla /pricing för aktuella kvoter.

Bädda in denna badge

Qwen: Qwen3.5-35B-A3B$0.06/M in3747ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg" alt="Qwen: Qwen3.5-35B-A3B på OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.5-35B-A3B](https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b)

Modellkort som data

GET /api/public/models/qwen/qwen3.5-35b-a3bÖppna