Qwen3 Max

qwen/qwen3-max
כליםJSONהיגיון
מאת Qwen · 2025-09-23

Qwen3 Max — מודל צ'אט דגל קנייני, הקשר 256k, מצב חשיבה + קריאת פונקציות.

נקודות קצה:/v1/chat/completions
הקשר262K tokens
מקסימום פלט65K
קלטtext
פלטtext
p50 TTFT3.39 s
קלט$0.36/ 1M טוקנים
פלט$1.43/ 1M טוקנים
p50 TTFT3.39 s7 ימים
p95 TTFT8.18 s7 ימים
תעבורה4.7Mטוקנים / 7 ימים

Qwen3 Max הוא מודל שפה מבוסס תערובת מומחים (MoE) מצוות Qwen של עליבאבא. הוא מיועד למשימות בעלות קיבולת גבוהה הדורשות הקשר מורחב וחשיבה מעמיקה. המודל מקבל קלטים מבוססי טקסט בלבד ותומך בחלון הקשר של…

מהו Qwen3 Max?

מי צריך להשתמש ב-Qwen3 Max?

מהו תפקידו של OrcaRouter?

אילו אופני קלט נתמכים?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

תמחור

דרגהקלט / 1M טוקניםפלט / 1M tokens
32K$0.359$1.434
128K$0.574$2.294
256K$1.004$4.014
הרמה נבחרת לפי מספר טוקני הקלט של כל בקשה

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $6.82

הערכה מבוססת מחיר מחירון

תמחור מדורג — הערכה זו משתמשת בתעריפי השכבה הבסיסית.

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000721

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
3.39 s
מהירות פלט
75.4 tok/s
p95 TTFT
8.18 s
שיעור שגיאות
0%

מבחני ביצועים ציבוריים

26.4
AA Coding
טוב יותר מ-26% מהמודלים שהושוו
#98 מתוך 133
24.5
AA Intelligence
טוב יותר מ-25% מהמודלים שהושוו
#101 מתוך 135
80.7
AA Math
טוב יותר מ-70% מהמודלים שהושוו
#24 מתוך 82
AIME 2025
80.7
GPQA Diamond
76.4
Humanity's Last Exam
11.9
IFBench
44.1
LiveCodeBench
76.7
Long-Context Recall
48.3
MMLU-Pro
84.1
SciCode
38.3
TerminalBench Hard
20.5
τ²-Bench
74.3
מקור: artificialanalysis.ai

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News11 אזכורים · 7 ימיםעלייה של 6 מול השבוע הקודם

איך זה משתווה

Qwen3 MaxQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
קלט $/מיליון$0.36$2.00$0.86$0.17
פלט $/מיליון$1.43$6.00$3.44$1.03
הקשר262K1.0M262K33K
איכות7/109/108/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מה העלות לטוקן עבור Qwen3 Max ב-OrcaRouter?
תמחור לפי אסימון (token) עבור Qwen3 Max מפורסם בדף התמחור של OrcaRouter ומשתנה לפי דרגת שימוש. אין דמי בסיס קבועים; אתה משלם רק עבור אסימוני קלט ופלט. בגלל ש-Qwen3 Max הוא מודל MoE גדול, העלות שלו לאסימון גבוהה יותר מאשר מודלים קטנים יותר אך תחרותית ביחס למודלים מובילים אחרים. בדוק באתר של OrcaRouter לתעריפים עדכניים.
מה גודל חלון ההקשר של Qwen3 Max?
Qwen3 Max תומך בחלון הקשר של 262,144 טוקנים, כלומר הוא יכול לקבל עד מספר זה של טוקנים כקלט (כולל הודעות מערכת ומשתמש). הפלט המרבי הוא 65,536 טוקנים לבקשה.
מהן החוזקות העיקריות של Qwen3 Max?
יתרונותיה העיקריים הם חלון הקשר רחב מאוד (262k טוקנים), תפוקה גבוהה (65k טוקנים), ביצועים חזקים במבחני חשיבה מקצועיים (MMLU-Pro 84.1), וארכיטקטורת MoE המאזנת בין יכולות ליעילות הסקה. היא אידיאלית לניתוח מסמכים ארוכים וחשיבה רב-שלבית מורכבת.
איך Qwen3 Max משתווה ל-GPT-4 או ל-Claude 3?
ההשוואות תלויות בגרסה הספציפית. ל-Qwen3 Max יש חלון הקשר גדול יותר מרוב הגרסאות של GPT-4 (128k עבור GPT-4 Turbo) ומגבלת פלט גבוהה יותר מזו של Claude 3 Opus (4k). ציוני הביצועים במבחן MMLU-Pro דומים לאלו של הדגמים המובילים, אך הביצועים בפועל משתנים לפי המשימה. OrcaRouter מציעה מספר דגמים; ניתן לבדוק זה לצד זה.
האם OrcaRouter מתאמן על הנתונים שלי כשאני משתמש ב-Qwen3 Max?
לא. OrcaRouter אינו משתמש בנתוני לקוחות לצורך אימון או שיפור מודלים. כל הקלטים והפלטים מעובדים אך ורק לצורך הסקה ונרשמים לצרכי חיוב ותפעול. נתונים אינם משותפים עם צדדים שלישיים מעבר לתשתית הנדרשת. עיין במדיניות הפרטיות של OrcaRouter לפרטים.
איך אני קורא ל-Qwen3 Max באמצעות API תואם OpenAI?
הגדר את כתובת הבסיס שלך ל-https://api.orcarouter.ai/v1, ספק את מפתח ה-API של OrcaRouter שלך, והשתמש במזהה המודל 'qwen/qwen3-max'. כל ערכות ה-SDK של OpenAI ולקוחות HTTP ישירים פועלים ללא שינוי. דוגמה: client = OpenAI(base_url='https://api.orcarouter.ai/v1', api_key='...') ולאחר מכן client.chat.completions.create(model='qwen/qwen3-max', messages=[...]).
מהם אופני הקלט והפלט הנתמכים?
Qwen3 Max מקבל קלט מבוסס טקסט בלבד ומייצר פלט מבוסס טקסט בלבד. אינו מעבד תמונות, אודיו או וידאו. למשימות רב-מודאליות, שקול מודלים כמו Qwen2-VL הזמינים ב-OrcaRouter.
האם אני יכול להשתמש בקריאת פונקציות עם Qwen3 Max?
כן, Qwen3 Max תומך בפורמט הקריאה לפונקציות ובשימוש בכלים התואם ל-OpenAI. ניתן להגדיר פונקציות בפרמטר 'tools', והמודל יכול לבקש לקרוא להן. זה עובד דרך ה-API של OrcaRouter ללא צורך בתצורה נוספת.
האם יש הגבלת קצב עבור Qwen3 Max ב-OrcaRouter?
OrcaRouter מיישם מגבלות קצב כדי להבטיח שימוש הוגן. מגבלות אלו מבוססות בדרך כלל על אסימונים לדקה ובקשות לדקה. המגבלות המדויקות תלויות בתוכנית שלך. בדוק בתיעוד של OrcaRouter או בלוח המחוונים שלך לקבלת תעריפים ספציפיים.
מהן המגבלות של Qwen3 Max?
כמו כל מודלי השפה הגדולים (LLMs), הוא עלול להזות או לייצר מידע שגוי, במיוחד בנושאים נדירים. יש לו נקודת חיתוך באימון (לא פורסמה בפומבי), ולכן אינו יכול לגשת לאירועים בזמן אמת ללא הקשר. ההקשר הגדול עלול להוביל להשפעות של 'אובדן באמצע'. הוא מבוסס טקסט בלבד ואינו מיועד ליישומים בזמן אמת ללא הזרמה (streaming).

הטמעת התג הזה

Qwen: Qwen3 Max$0.36/M in3393ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3-max.svg" alt="Qwen: Qwen3 Max ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3 Max](https://www.orcarouter.ai/embed/qwen/qwen3-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3-max)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3-maxפתיחה
קריא למכונה:/llms.txt/llms-full.txt