Qwen3.7 Max

qwen/qwen3.7-max
מאת qwen · 2026-05-22

Qwen3.7-Max — דגם הדגל הקנייני של Alibaba, שתוכנן כתשתית לעידן הסוכנים. חלון הקשר מקורי של 1M טוקנים, עם מצב חשיבה מורחב (ו-preserve_thinking בין סבבים) מותאם למשימות סוכניות. תוצאות ברמה גבולית בקידוד (SWE-Verified, SWE-Pro, Terminal-Bench), חשיבה (GPQA Diamond, HMMT, IMO), שימוש בכלים (BFCL, MCP-Mark, MCP-Atlas), ובנצ'מרקים רב-לשוניים (WMT24++ על פני 55 שפות). מהונדס לביצוע אוטונומי לטווח ארוך — שומר על אסטרטגיה קוהרנטית לאורך אלפי קריאות לכלים וסשנים בני שעות רבות — ומכליל באופן עקבי על פני פיגומים שונים של סוכנים, כולל Claude Code, OpenClaw ו-Qwen Code. מומלץ לסוכני קידוד, אוטומציה של משרדים וזרימות עבודה, RAG עם הקשר ארוך, וכל מערכת הזקוקה לעמוד שדרה אמין לשימוש מתמשך בכלים.

הקשר1M tokens
מקסימום פלט64K
קלטtext
פלטtext
p50 TTFT10.00 s
קלט$1.25/ 1M טוקנים
פלט$3.75/ 1M טוקנים
p50 TTFT10.00 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה39.3Mטוקנים / 7 ימים

Qwen3.7 Max הוא מודל שפה מבוסס טקסט בלבד שפותח על ידי צוות Qwen, המיועד לטיפול בהקשרים ארוכים במיוחד — עד 1,000,000 טוקנים — תוך יצירת פלטים של עד 64,000 טוקנים. הוא נגיש דרך ה-API התואם ל-OpenAI של…

מה זה Qwen3.7 Max?

למי מיועד Qwen3.7 Max?

איך Qwen3.7 Max מטפל בהקשרים ארוכים?

מהן המגבלות של הקלט והפלט?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

תמחור

קלט / 1M טוקנים$1.25
פלט / 1M tokens$3.75
קריאת מטמון / 1M$0.250
כתיבה למטמון / 1M$1.563
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $20.00 · עם מטמון הנחיות $16.50

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.001890

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
10.00 s
מהירות פלט
624 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
5.8%

מבחני ביצועים ציבוריים

66.0
AA Coding
טוב יותר מ-82% מהמודלים שהושוו
#21 מתוך 123
46.0
AA Intelligence
טוב יותר מ-78% מהמודלים שהושוו
#27 מתוך 125
71.0
AA Math
טוב יותר מ-65% מהמודלים שהושוו
#28 מתוך 81
GPQA Diamond
92.3
Humanity's Last Exam
38.1
IFBench
80.5
Long-Context Recall
69.0
MMLU-Pro
77.0 index
SciCode
48.8
tau_banking
10.9
TerminalBench Hard
50.8
terminalbench_v2_1
74.5
τ²-Bench
94.7
מקור: artificialanalysis.ai

איך זה משתווה

Qwen3.7 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
קלט $/מיליון$1.25$0.86$0.17$0.12
פלט $/מיליון$3.75$3.44$1.03$0.69
הקשר1.0M262K33K1.0M
איכות5/108/108/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות המדויקת לטוקן עבור Qwen3.7 Max?
עלות של טוקני קלט היא $1.25 למיליון טוקנים, ועלות של טוקני פלט היא $3.75 למיליון טוקנים. אין תווך מ-OrcaRouter; אתה משלם את תעריף הספק מ-Qwen.
מהו גודל חלון ההקשר של Qwen3.7 Max?
חלון ההקשר הוא 1,000,000 אסימונים (מיליון). הפלט המרבי הוא 64,000 אסימונים. הקלט הוא טקסט בלבד.
מהן החוזקות העיקריות של Qwen3.7 Max?
החוזק העיקרי הוא היכולת לטפל בהקשרים ארוכים מאוד (1M tokens) וליצור עד 64K tokens בבקשה אחת. הוא טקסט בלבד ומתומחר ב-$1.25/$3.75 לכל 1M tokens.
איך Qwen3.7 Max משתווה למודלים אחרים בעלי הקשר רחב?
היא מציעה חלון הקשר של 1M tokens, בדומה ל-Gemini 1.5 Pro, אך היא טקסט בלבד. המחירים תחרותיים: $1.25 קלט / $3.75 פלט. ציוני Benchmark לא סופקו, כך שהשוואה ישירה אינה אפשרית. עבור משימות מולטי-מודליות, בחר מודל אחר.
האם Qwen3.7 Max מתאים ליישומים בזמן אמת?
השהיה (Latency) אינה מוגדרת, אך מודלים עם חלונות הקשר גדולים מאוד נוטים לזמני הסקה ארוכים יותר. לשימוש בזמן אמת, בצע בדיקה עם גודל הקלט האופייני שלך. לדרישות השהיה נמוכה, שקול להשתמש במודל קטן יותר.
איך אני ניגש ל- Qwen3.7 Max דרך API?
גש אליו דרך ה-API התואם ל-OpenAI של OrcaRouter בכתובת https://api.orcarouter.ai/v1 באמצעות מזהה המודל "qwen/qwen3.7-max". השתמש במפתח ה-API שלך ובערכות ה-SDK הסטנדרטיות של OpenAI. הגדר את base_url בהתאם.
האם Qwen3.7 Max תומך בתמונות או אודיו?
לא, המודל מיועד לטקסט בלבד. הוא מקבל רק קלטי טקסט ומייצר פלטי טקסט. עבור משימות מולטי-מודליות, השתמשו במודל אחר.
מה קורה אם הקלט שלי עולה על מיליון טוקנים?
המודל ידחה את הבקשה או יקצץ את הקלט. עליך לפצל את הטקסט למספר בקשות או להשתמש בגישה אחרת. אורך ההקשר המקסימלי הוא בקפדנות 1,000,000 טוקנים.
האם יש הנחות לשימוש בנפח גבוה?
אין אזכור להנחות או להטבות שמירה במטמון בעובדות שסופקו. צור קשר ישירות עם OrcaRouter או Qwen לקבלת תמחור נפח אפשרי. מודל ללא תוספת מחיר כבר מבטיח שתשלם את תעריף הספק.
האם אני יכול לכוונן את Qwen3.7 Max?
העובדות שסופקו אינן מצביעות על כך שהכוונון עדין (fine-tuning) זמין. בדרך כלל, מודל זה מוצע להסקה בלבד. להתאמה אישית, השתמשו בהנדסת פרומפטים (prompt engineering) ובכמה דוגמאות (few-shot examples). להכוונון עדין, שקלו מודלים קטנים יותר אם הם זמינים.

הטמעת התג הזה

Qwen3.7 Max$1.25/M in10000ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-max.svg" alt="Qwen3.7 Max ב-OrcaRouter" /> </a>
Markdown [![Qwen3.7 Max](https://www.orcarouter.ai/embed/qwen/qwen3.7-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-max)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3.7-maxפתיחה
קריא למכונה:/llms.txt/llms-full.txt