Gemini 3 Flash Preview

google/gemini-3-flash-preview
ראייהאודיוכליםJSONהיגיון
מאת Google · 2025-12-17

Gemini 3 Flash Preview הוא מודל חשיבה במהירות גבוהה ובעל ערך גבוה המיועד לזרימות עבודה סוכניות, שיחות מרובות פניות וסיוע בתכנות. הוא מספק חשיבה כמעט ברמת Pro וכלי...

הקשר1.05M tokens
מקסימום פלט65.5K
קלטtext + image + file + audio + video
פלטtext
p50 TTFT10.00 s
קלט$0.50/ 1M טוקנים
פלט$3.00/ 1M טוקנים
p50 TTFT10.00 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה2.8Mטוקנים / 7 ימים

גוגל Gemini 3 Flash Preview הוא מודל רב-מודאלי שפותח על ידי גוגל, המותאם למהירות ולעיבוד הקשר רחב. הוא מקבל קלט בפורמטים של טקסט, תמונה, קובץ, אודיו ווידאו, ויכול ליצור עד 65,536 אסימונים של פלט.…

מה זה Google Gemini 3 Flash Preview?

מיהו קהל היעד של המודל הזה?

באילו קלטים מולטימודליים הוא תומך?

מה מצב התצוגה המקדימה ועד כמה היא יציבה?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

תמחור

קלט / 1M טוקנים$0.500
פלט / 1M tokens$3.00
קריאת מטמון / 1M$0.050
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $12.50 · עם מטמון הנחיות $10.93

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.001506

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
10.00 s
מהירות פלט
3445 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
0%

מבחני ביצועים ציבוריים

37.8
AA Coding
טוב יותר מ-39% מהמודלים שהושוו
#72 מתוך 123
27.4
AA Intelligence
טוב יותר מ-33% מהמודלים שהושוו
#84 מתוך 125
55.7
AA Math
טוב יותר מ-32% מהמודלים שהושוו
#55 מתוך 81
AIME 2025
55.7
GPQA Diamond
81.2
Humanity's Last Exam
14.1
IFBench
55.1
LiveCodeBench
79.7
Long-Context Recall
48.0
MMLU-Pro
88.2
SciCode
49.9
TerminalBench Hard
31.8
τ²-Bench
43.3
מקור: artificialanalysis.ai

איך זה משתווה

Gemini 3 Flash PreviewGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3.5 Flash
קלט $/מיליון$0.50$2.00$4.00$1.50
פלט $/מיליון$3.00$12.00$18.00$9.00
הקשר1.0M1.0M1.0M1.0M
איכות9/1010/1010/109/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מה העלות להשתמש ב-Gemini 3 Flash Preview?
התמחור הוא $0.50 למיליון אסימוני קלט ו-$3.00 למיליון אסימוני פלט, מחויב בתעריף הספק ללא תוספת מרווח מ-OrcaRouter.
מהו גודל חלון ההקשר?
חלון ההקשר הוא 1,048,576 אסימונים עבור קלט והמודל יכול ליצור עד 65,536 אסימוני פלט.
מהן אופני הקלט הנתמכים?
טקסט, תמונה, קובץ, אודיו ווידאו – כולם מתקבלים כקלט. הפלט הוא טקסט בלבד.
איך זה משתווה ל-Gemini 2 Flash?
ל-Gemini 3 Flash Preview יש חלון הקשר גדול יותר (1M לעומת עד 1M אך לעתים קטן יותר), ציון MMLU-Pro גבוה יותר (88.2), ותמיכה מולטימודלית מורחבת הכוללת וידאו. הוא מהיר יותר ומסוגל יותר למשימות מורכבות, אך Gemini 2 Flash זול יותר לטוקן.
כיצד OrcaRouter מטפל בפרטיות נתונים?
OrcaRouter מעביר את הבקשות שלך ל-API של Google. טיפול בנתונים מתבצע לפי מדיניות הפרטיות של Google. OrcaRouter אינו רושם או שומר את התוכן שלך מעבר לנדרש לעיבוד הבקשה. עיין במדיניות של שני הספקים לפרטים נוספים.
האם אני יכול לקרוא ל-Gemini 3 Flash Preview באמצעות API תואם OpenAI?
כן. השתמש ב-API של OrcaRouter בכתובת https://api.orcarouter.ai/v1 עם מזהה מודל "google/gemini-3-flash-preview". האימות משתמש במפתח API של OrcaRouter. פורמטי הבקשה והתגובה עוקבים אחרי הסכימה של Chat Completions של OpenAI.
מהם היתרונות העיקריים של המודל?
מהירות הסקה גבוהה, הקשר של מיליון טוקנים (1M-token), קלט מולטימודלי (טקסט, תמונה, קובץ, שמע, וידאו), ביצועים חזקים במדד MMLU-Pro (88.2), ועלות נמוכה יחסית לדגמים גדולים יותר.
האם Gemini 3 Flash Preview זמין לייצור?
זוהי גרסת תצוגה מקדימה, כלומר ייתכנו בה שינויים, זמינות לסירוגין או תמיכה מוגבלת. היא מתאימה לבדיקות ופיתוח; עבור עומסי עבודה קריטיים בייצור, שקלו להשתמש בגרסה היציבה כשתהיה זמינה.
כיצד אוכל להעריך את השימוש בטוקנים עבור קלטים רב-מודליים?
לכל מודאליות יש טוקניזציה משלה. תמונות, שמע ווידאו מפוצלים לטוקנים לפי רזולוציה ומשך זמן. OrcaRouter מדווח על שימוש בטוקנים בתגובת ה-API. ניתן גם לעיין בתיעוד של Google לקבלת כללי ספירת טוקנים מפורטים.
מה קורה אם אני חורג מגודל חלון ההקשר?
קלטים החורגים מ-1,048,576 טוקנים יקוצצו מהתוכן הישן ביותר. המודל יתעלם מהטוקנים העודפים. ודא שההודעות שלך מתאימות למגבלה על ידי ניטור סך הטוקנים בבקשה שלך.

הטמעת התג הזה

Google: Gemini 3 Flash Preview$0.50/M in10000ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3-flash-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg" alt="Google: Gemini 3 Flash Preview ב-OrcaRouter" /> </a>
Markdown [![Google: Gemini 3 Flash Preview](https://www.orcarouter.ai/embed/google/gemini-3-flash-preview.svg)](https://www.orcarouter.ai/models/google/gemini-3-flash-preview)

כרטיס מודל כנתונים

GET /api/public/models/google/gemini-3-flash-previewפתיחה
קריא למכונה:/llms.txt/llms-full.txt