Qwen3.5-35B-A3B

qwen/qwen3.5-35b-a3b
WizjaNarzędziaJSONRozumowanie
przez Qwen · 2026-02-25

Qwen3.5 35B-A3B — multimodalny MoE (tekst/obraz/wideo) o otwartej wadze, 35B całkowitych / 3B aktywnych parametrów, kontekst 32k (tryb wizyjny).

Punkty końcowe:/v1/chat/completions
kont.32K tokenów
Maks. wyjście65K
Wejścietext + image + video
Wyjścietext
p50 TTFT3.15 s
WEJŚCIE$0.06/ 1M tokenów
WYJŚCIE$0.46/ 1M tokenów
p50 TTFT3.15 s7 d
p95 TTFT10.00 s7 d
RUCH366.0Ktokenów / 7 d

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Cennik

PoziomWejście / 1M tokenówWyjście / 1M tokenów
128K$0.057$0.459
$0.229$1.835
Poziom wybierany na podstawie liczby tokenów wejściowych każdego żądania

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $1.78

Szacunek na podstawie cennika

Ceny progowe — ten szacunek używa stawek progu podstawowego.

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000231

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
3.15 s
Prędkość wyjścia
114 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
0%

Publiczne benchmarki

63.9
AA Coding
Lepszy niż 71% porównywanych modeli
40 z 138
22.6
AA Intelligence
Lepszy niż 29% porównywanych modeli
99 z 140
69.9
AA Math
Lepszy niż 61% porównywanych modeli
32 z 82
GPQA Diamond
84.5
Humanity's Last Exam
21.0
IFBench
72.5
Long-Context Recall
72.0
MMLU-Pro
71.9 index
SciCode
37.7
TerminalBench Hard
26.5
τ²-Bench
89.2
Źródło: artificialanalysis.ai

Aktywność społeczności

O czym mówią programiści w tym tygodniu

Hacker News0 wzmianek · 7 dni

Porównanie

Qwen3.5-35B-A3BQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
Wejście $/M$0.06$2.00$2.00$0.86
Wyjście $/M$0.46$6.00$6.00$3.44
Kontekst33K1.0M1.0M262K
Jakość6/109/109/108/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Ile kosztuje Qwen: Qwen3.5-35B-A3B na OrcaRouter?
Qwen: Qwen3.5-35B-A3B jest wyceniany na $0.06 za 1M tokenów wejściowych i $0.46 za 1M tokenów wyjściowych za pośrednictwem OrcaRouter. Ceny są pobierane na żywo z warstwy routingu.
Jakie jest okno kontekstowe Qwen: Qwen3.5-35B-A3B?
Qwen: Qwen3.5-35B-A3B obsługuje okno kontekstu o wielkości 33K tokenów. Używaj funkcji długiego kontekstu (RAG, streszczanie) do tego limitu.
Jak wywołać Qwen: Qwen3.5-35B-A3B za pomocą OpenAI SDK?
Ustaw base_url OpenAI na https://api.orcarouter.ai/v1, podaj swój klucz API OrcaRouter i przekaż model="qwen/qwen3.5-35b-a3b" w wywołaniu chat.completions.create.
Czy OrcaRouter ogranicza przepustowość Qwen: Qwen3.5-35B-A3B?
Limity szybkości na model są zgodne z Twoim planem OrcaRouter. Darmowe plany mają niskie limity; płatne plany je podnoszą. Sprawdź /pricing, aby zobaczyć aktualne limity.

Osadź tę odznakę

Qwen: Qwen3.5-35B-A3B$0.06/M in3153ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg" alt="Qwen: Qwen3.5-35B-A3B w OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.5-35B-A3B](https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b)

Karta modelu jako dane

GET /api/public/models/qwen/qwen3.5-35b-a3bOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt