Qwen3.5-35B-A3B

qwen/qwen3.5-35b-a3b
ראייהכליםJSONהיגיון
מאת Qwen · 2026-02-25

Qwen3.5 35B-A3B — משקלים פתוחים MoE רב-מודלי (טקסט/תמונה/וידאו), 35B סה"כ / 3B פרמטרים פעילים, הקשר 32k (מצב ראייה).

נקודות קצה:/v1/chat/completions
הקשר32.8K tokens
מקסימום פלט65.5K
קלטtext + image + video
פלטtext
p50 TTFT3.75 s
קלט$0.06/ 1M טוקנים
פלט$0.46/ 1M טוקנים
p50 TTFT3.75 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה206.3Mטוקנים / 7 ימים

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-35b-a3b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

תמחור

דרגהקלט / 1M טוקניםפלט / 1M tokens
128K$0.057$0.459
256K$0.229$1.835
הרמה נבחרת לפי מספר טוקני הקלט של כל בקשה

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $1.78

הערכה מבוססת מחיר מחירון

תמחור מדורג — הערכה זו משתמשת בתעריפי השכבה הבסיסית.

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000230

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
3.75 s
מהירות פלט
148 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
5.6%

מבחני ביצועים ציבוריים

63.9
AA Coding
טוב יותר מ-80% מהמודלים שהושוו
#24 מתוך 123
29.3
AA Intelligence
טוב יותר מ-35% מהמודלים שהושוו
#80 מתוך 125
69.9
AA Math
טוב יותר מ-62% מהמודלים שהושוו
#31 מתוך 81
GPQA Diamond
84.5
Humanity's Last Exam
19.7
IFBench
72.5
Long-Context Recall
62.7
MMLU-Pro
71.9 index
SciCode
37.7
TerminalBench Hard
26.5
τ²-Bench
89.2
מקור: artificialanalysis.ai

איך זה משתווה

Qwen3.5-35B-A3Bqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
קלט $/מיליון$0.06$0.86$0.17$0.12
פלט $/מיליון$0.46$3.44$1.03$0.69
הקשר33K262K33K1.0M
איכות6/108/108/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

כמה עולה Qwen: Qwen3.5-35B-A3B ב-OrcaRouter?
Qwen: Qwen3.5-35B-A3B מתומחר ב-$0.06 לכל 1M טוקני קלט ו-$0.46 לכל 1M טוקני פלט דרך OrcaRouter. התמחור נמשך בזמן אמת משכבת הניתוב.
מהו חלון ההקשר של Qwen: Qwen3.5-35B-A3B?
Qwen: Qwen3.5-35B-A3B תומך בחלון הקשר של 33K טוקנים. השתמש בתכונות הקשר ארוך (RAG, סיכום) עד לגבול זה.
איך אני קורא ל-Qwen: Qwen3.5-35B-A3B דרך OpenAI SDK?
הגדר את base_url של OpenAI ל-https://api.orcarouter.ai/v1, ספק את מפתח ה-API של OrcaRouter שלך, והעבר את model="qwen/qwen3.5-35b-a3b" בקריאה ל-chat.completions.create.
האם OrcaRouter מגביל קצב ל-Qwen: Qwen3.5-35B-A3B?
מגבלות קצב לפי מודל עוקבות אחרי תוכנית OrcaRouter שלך. רמות חינמיות מגיעות עם מגבלות שמרניות; רמות בתשלום מסירות אותן. בדוק /pricing עבור המכסות הנוכחיות.

הטמעת התג הזה

Qwen: Qwen3.5-35B-A3B$0.06/M in3747ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg" alt="Qwen: Qwen3.5-35B-A3B ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.5-35B-A3B](https://www.orcarouter.ai/embed/qwen/qwen3.5-35b-a3b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-35b-a3b)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3.5-35b-a3bפתיחה
קריא למכונה:/llms.txt/llms-full.txt