Qwen3.5-122B-A10B

qwen/qwen3.5-122b-a10b
ראייהכליםJSONהיגיון
מאת Qwen · 2026-02-25

Qwen3.5 122B-A10B — משקל פתוח MoE רב-מודאלי (טקסט/תמונה/וידאו), 122B סה״כ / 10B פרמטרים פעילים, הקשר של 32k (מצב ראייה).

נקודות קצה:/v1/chat/completions
הקשר32K tokens
מקסימום פלט65K
קלטtext + image + video
פלטtext
p50 TTFT800 ms
קלט$0.12/ 1M טוקנים
פלט$0.92/ 1M טוקנים
p50 TTFT800 ms7 ימים
p95 TTFT2.06 s7 ימים
תעבורה12.5Kטוקנים / 7 ימים

Qwen3.5-122B-A10B הוא מודל שפה גדול מסדרת Qwen של Alibaba Cloud. הוא משתמש בארכיטקטורת mixture-of-experts (MoE), שבה רק 10 מיליארד פרמטרים מופעלים בכל מעבר קדימה, בעוד שסך הפרמטרים הוא 122 מיליארד.…

מה זה Qwen3.5-122B-A10B?

למי מיועד המודל הזה?

אילו יכולות מולטי-מודליות הוא מציע?

איך זה משתווה לדגמי Qwen האחרים בסדרה?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-122b-a10b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

תמחור

דרגהקלט / 1M טוקניםפלט / 1M tokens
≤ 128K$0.115$0.917
≤ ∞$0.287$2.294
הרמה נבחרת לפי מספר טוקני הקלט של כל בקשה

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $3.56

הערכה מבוססת מחיר מחירון

תמחור מדורג — הערכה זו משתמשת בתעריפי השכבה הבסיסית.

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000460

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
800 ms
מהירות פלט
99.2 tok/s
p95 TTFT
2.06 s
שיעור שגיאות
0%

מבחני ביצועים ציבוריים

45.7
AA Coding
טוב יותר מ-47% מהמודלים שהושוו
#73 מתוך 138
15.6
AA Intelligence
טוב יותר מ-22% מהמודלים שהושוו
#111 מתוך 145
GPQA Diamond
85.7
Humanity's Last Exam
25.2
IFBench
75.7
Long-Context Recall
76.3
SciCode
39.7
tau_banking
15.3
TerminalBench Hard
31.1
terminalbench_v2_1
47.6
τ²-Bench
93.6
מקור: artificialanalysis.ai

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימים

איך זה משתווה

Qwen3.5-122B-A10BQwen3.8 MaxQwen3.8 Max (0902)qwen/qwen3-max-preview
קלט $/מיליון$0.12$2.00$2.00$0.86
פלט $/מיליון$0.92$6.00$6.00$3.44
הקשר33K1.0M1.0M262K
איכות7/109/109/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מה העלות של שימוש ב-Qwen3.5-122B-A10B על OrcaRouter?
התמחור המדויק אינו מפורש בפומבי בעובדות הזמינות. OrcaRouter בדרך כלל גובה עבור כל טוקן לקלט ופלט, כאשר טוקנים מולטימודליים מחויבים בתעריף גבוה יותר. עיינו בדף התמחור של OrcaRouter או פנו לתמיכה לקבלת התעריפים העדכניים.
מהו גודל חלון ההקשר של המודל הזה?
חלון ההקשר תומך בעד 32,768 טוקנים (כולל הודעות, תמונות ופריימים של וידאו). האורך המרבי של הפלט הוא 65,536 טוקנים.
מהם היתרונות העיקריים של Qwen3.5-122B-A10B?
חוזקותיו כוללות ציון גבוה ב-τ²-Bench (93.6) המעיד על שימוש חזק בכלים והסקה מרובת שלבים, תמיכה בקלט רב-מודלי (טקסט, תמונה, וידאו), ומגבלת פלט גדולה. ארכיטקטורת MoE מאזנת בין קיבולת ויעילות.
איך המודל הזה משתווה ל-Llama 3.1 או ל-Claude?
בנצ'מרקים ישירים מוגבלים. לדגם זה יש ציון גבוה בשימוש בכלים וקלט מולטי-מודאלי, בעוד ש-Llama 3.1 הוא טקסט בלבד (למעט גרסאות ראייה) ול-Claude יש חלונות הקשר גדולים יותר. הביצועים ישתנו לפי המשימה; מומלץ לבדוק על הנתונים הספציפיים שלך.
האם OrcaRouter מטפל בנתוני משתמשים ובפרטיות בעת השימוש במודל זה?
מדיניות הטיפול בנתונים אינה מפורטת בעובדות המסופקות. על המשתמשים לעיין בתנאי השירות ובמדיניות הפרטיות של OrcaRouter. בדרך כלל, נתוני קלט ופלט עשויים לעבור עיבוד בשרתי ענן; יש להתייחס לנתונים רגישים בהתאם.
כיצד אני יכול לקרוא למודל זה באמצעות ה-API התואם ל-OpenAI?
שלח בקשת POST ל-https://api.orcarouter.ai/v1/chat/completions עם פרמטר המודל מוגדר ל-'qwen/qwen3.5-122b-a10b'. ה-API תומך באותו פורמט הודעות כמו OpenAI, כולל תוכן רב-מודאלי באמצעות image_url ו-video blocks.
מהי מגבלת טוקן הפלט המקסימלית?
המודל יכול לייצר עד 65,536 טוקנים בהשלמה אחת. ניתן לשלוט בזה באמצעות הפרמטר max_tokens בבקשת ה-API.
האם המודל הזה יכול לעבד סרטונים?
כן, הוא מקבל קלט וידאו (בנוסף לטקסט ותמונות). שיטת הקידוד המדויקת (למשל, דגימת פריימים) אינה מפורטת, אך המודל יכול לפרש פריימי וידאו כחלק מההקשר הרב-מודלי.

הטמעת התג הזה

Qwen: Qwen3.5-122B-A10B•$0.12/M in•800ms p50•דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-122b-a10b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-122b-a10b.svg" alt="Qwen: Qwen3.5-122B-A10B ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.5-122B-A10B](https://www.orcarouter.ai/embed/qwen/qwen3.5-122b-a10b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-122b-a10b)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3.5-122b-a10bפתיחה
קריא למכונה:/llms.txt/llms-full.txt