Qwen3.7 Flash

qwen/qwen3.7-flash
חדשמומלץ
ראייהכליםJSONהיגיון
מאת Qwen · 2026-07-27

Qwen3.7 Flash הוא המודל המהיר והחסכוני ביותר של עליבאבא במשפחת Qwen3.7, הממוקם מתחת ל-Qwen3.7-Plus ו-Qwen3.7-Max כשכבה בעלת תפוקה גבוהה. הוא רב-מודאלי במקור בצד הקלט — מקבל טקסט, תמונות ווידאו עם פלט טקסט — ומספק חלון הקשר של 1M טוקנים עם עד 64K טוקני פלט, כך שמסמכים ארוכים, צילומי מסך ופריימים של וידאו נשארים בהישג יד גם בתמחור של Flash. בערך $0.03 למיליון טוקני קלט בשכבה הבסיסית, הוא אחד מהמודלים הרב-מודאליים הזולים ביותר עם 1M הקשר, מה שהופך אותו להתאמה טבעית לסיווג, שליפה, ניתוב, תמצות, סוכנים קלים, וכל צינור עיבוד הפועל בנפח גבוה מאוד. הוא תומך במצב חשיבה, קריאה מקורית לפונקציות, פלט מובנה באמצעות response_format, ובקרות הדגימה הרגילות (temperature / top_p / seed / logprobs). שימו לב שהתמחור מדורג לפי אורך prompt: העלויות עולות מעל 32K ושוב מעל 256K טוקני קלט, כך שאיגום בקשות קצרות הוא זול משמעותית מאשר ריפוד ארוכות. השתמשו ב-Flash כסוס העבודה בנפח גבוה, ועברו ל-Qwen3.7-Plus או Max כאשר משימה באמת דורשת יותר יכולת.

הקשר1M tokens
מקסימום פלט65K
קלטtext + image + video
פלטtext
p50 TTFT2.83 s
קלט$0.03/ 1M טוקנים
פלט$0.13/ 1M טוקנים
p50 TTFT2.83 s7 ימים
p95 TTFT9.64 s7 ימים
תעבורה13.5Mטוקנים / 7 ימים

Qwen3.7 Flash הוא מודל שפה רב-מודאלי (multimodal large language model) שנוצר על ידי צוות Qwen וזמין דרך OrcaRouter. הוא מעבד תשומות טקסט, תמונה ווידאו, ותומך בחלון הקשר (context window) של 1,000,000…

מהו Qwen3.7 Flash ומי צריך להשתמש בו?

אילו מצבי קלט נתמכים ב-Qwen3.7 Flash?

מהו גודל חלון ההקשר של Qwen3.7 Flash?

איך ניגשים ל-Qwen3.7 Flash דרך OrcaRouter?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

תמחור

דרגהקלט / 1M טוקניםפלט / 1M tokensקריאת מטמון / 1Mכתיבה למטמון / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
הרמה נבחרת לפי מספר טוקני הקלט של כל בקשה

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $0.600 · עם מטמון הנחיות $0.516

הערכה מבוססת מחיר מחירון

תמחור מדורג — הערכה זו משתמשת בתעריפי השכבה הבסיסית.

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000065

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
2.83 s
מהירות פלט
333 tok/s
p95 TTFT
9.64 s
שיעור שגיאות
0%

מבחני ביצועים ציבוריים

מקור: Design Arena

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימים

איך זה משתווה

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
קלט $/מיליון$0.03$0.86$0.17$0.12
פלט $/מיליון$0.13$3.44$1.03$0.69
הקשר1.0M262K33K1.0M
איכות7/108/108/108/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

כמה עולה Qwen3.7 Flash ב-OrcaRouter?
אין תמחור ספציפי עבור Qwen3.7 Flash במידע הזמין. OrcaRouter בדרך כלל גובה מחיר לפי אסימון (token) עבור קלט ופלט. בתור מודל Flash, סביר להניח שהוא מתומחר נמוך יותר ממודלים מובילים. בקר בדף התמחור של OrcaRouter או צור קשר עם התמיכה לקבלת תעריפים עדכניים.
מהו גודל חלון ההקשר של Qwen3.7 Flash?
חלון ההקשר הוא 1,000,000 אסימונים. זה מאפשר למודל לעבד מסמכים ארוכים מאוד, שיחות מורחבות, או סטים גדולים של תמונות/סרטונים בהנחיה אחת.
מהם היתרונות של Qwen3.7 Flash?
יתרונותיו כוללים הקשר של מיליון טוקנים, תמיכה בכניסות מולטי-מודליות (טקסט, תמונה, וידאו), עד 65k טוקנים בפלט, וארכיטקטורת 'Flash' מותאמת המאזנת בין מהירות לעלות. הוא מתאים במיוחד לניתוח מסמכים ארוכים ולהבנה מולטי-מודלית.
איך Qwen3.7 Flash משתווה ל-GPT-4o-mini?
Qwen3.7 Flash מציע חלון הקשר גדול משמעותית (1M לעומת 128k) ותפוקה מרבית גבוהה יותר (65k לעומת 16k). GPT-4o-mini עשוי לתמוך במערכת אקולוגית רחבה יותר. לא מסופקים תמחור או מדדי ביצוע להשוואה ישירה.
האם OrcaRouter שומר במטמון הנחיות כדי להפחית עלויות?
OrcaRouter עשוי להציע אחסון במטמון של Prompt, אך המדיניות הספציפית שלו עבור Qwen3.7 Flash אינה מפורטת בעובדות. יש לבדוק בתיעוד של OrcaRouter אינדיקטורים לפגיעות מטמון ומידע על הנחות.
איך אני קורא ל-Qwen3.7 Flash באמצעות API תואם OpenAI?
הגדר את כתובת ה-URL הבסיסית ל-https://api.orcarouter.ai/v1 והשתמש במזהה המודל "qwen/qwen3.7-flash". כלול את מפתח ה-API של OrcaRouter שלך. נקודת הקצה של chat completions פועלת עם הפרמטרים הסטנדרטיים של OpenAI. לקלט מולטימודלי, הוסף אובייקטים של תמונה או וידאו במערך תוכן ההודעה.
אילו מצבי קלט נתמכים ב-Qwen3.7 Flash?
זה תומך בקלט טקסט, תמונה ווידאו. זה מאפשר משימות כמו ניתוח תמונות לצד טקסט, סיכום וידאו ושילוב סוגי מדיה מרובים בהנחיה אחת.
האם אני יכול לבצע כוונון עדין של Qwen3.7 Flash על הנתונים שלי?
העובדות הזמינות אינן מזכירות יכולות כיוונון עדין. כמודל הנגיש דרך API באמצעות OrcaRouter, ככל הנראה כיוונון עדין אינו נתמך. עבור כיוונון עדין מותאם אישית, שקלו חלופות בקוד פתוח.
מהו אורך הפלט המקסימלי של Qwen3.7 Flash?
הפלט המקסימלי הוא 65,536 אסימונים. זה מאפשר יצירת תגובות, דוחות או קוד ארוכים מאוד בקריאה אחת של API.
איך לטפל בקלטי וידאו עם Qwen3.7 Flash?
פרטים ספציפיים על טיפול בווידאו אינם מסופקים. בדרך כלל, קלטי וידאו מעובדים כרצפים של פריימים. ייתכן שתצטרך לעבד מראש סרטונים לסדרה של תמונות ולהעביר אותן ככתובות URL של תמונות או כנתוני base64. עיין בתיעוד של OrcaRouter לקבלת פורמט מדויק.

הטמעת התג הזה

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash ב-OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

כרטיס מודל כנתונים

GET /api/public/models/qwen/qwen3.7-flashפתיחה
קריא למכונה:/llms.txt/llms-full.txt