Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
ראייהאודיוכליםJSONהיגיון
מאת Google · 2025-07-22

Gemini 2.5 Flash-Lite הוא מודל חשיבה קל משקל במשפחת Gemini 2.5, המותאם לעיכוב נמוך במיוחד ויעילות עלות. הוא מציע תפוקה משופרת, יצירת טוקנים מהירה יותר וביצועים טובים יותר...

הקשר1M tokens
מקסימום פלט65K
קלטtext + image + file + audio + video
פלטtext
p50 TTFT1.34 s
קלט$0.10/ 1M טוקנים
פלט$0.40/ 1M טוקנים
p50 TTFT1.34 s7 ימים
p95 TTFT8.52 s7 ימים
תעבורה11.3Mטוקנים / 7 ימים

Google Gemini 2.5 Flash Lite הוא גרסה קטנה, מהירה וזולה יותר של דגם Gemini 2.5 Flash מבית Google. הוא נועד להתמודד עם מגוון רחב של קלטים מולטימודליים – כולל טקסט, תמונות, קבצים, אודיו ווידאו – תוך…

מה זה Google Gemini 2.5 Flash Lite?

מי צריך להשתמש במודל זה?

אילו אופני קלט הוא תומך?

איך זה משתווה לדגמים אחרים של גוגל?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

תמחור

קלט / 1M טוקנים$0.100
פלט / 1M tokens$0.400
קריאת מטמון / 1M$0.010
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $1.90 · עם מטמון הנחיות $1.59

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.000201

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
1.34 s
מהירות פלט
541 tok/s
p95 TTFT
8.52 s
שיעור שגיאות
0.44%

מבחני ביצועים ציבוריים

7.4
AA Coding
טוב יותר מ-1% מהמודלים שהושוו
#125 מתוך 126
6.7
AA Intelligence
טוב יותר מ-3% מהמודלים שהושוו
#122 מתוך 128
35.3
AA Math
טוב יותר מ-12% מהמודלים שהושוו
#71 מתוך 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
מקור: artificialanalysis.ai

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימיםירידה של 1 מול השבוע הקודם

איך זה משתווה

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
קלט $/מיליון$0.10$2.00$4.00$0.50
פלט $/מיליון$0.40$12.00$18.00$3.00
הקשר1.0M1.0M1.0M1.0M
איכות2/1010/1010/109/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות לאסימון עבור Gemini 2.5 Flash Lite ב-OrcaRouter?
עלות tokenי קלט היא $0.10 לכל 1 מיליון token, עלות tokenי פלט היא $0.40 לכל 1 מיליון token. OrcaRouter מחייבת בתעריף הספק ללא תוספת מחיר.
מהו גודל חלון ההקשר?
חלון ההקשר הוא 1,048,576 טוקנים (מיליון טוקנים), והפלט המקסימלי הוא 65,536 טוקנים.
מהם היתרונות העיקריים של המודל?
החוזקות כוללות עלות נמוכה, מהירות גבוהה, יכולות חשיבה מתמטית חזקות (92.6 ב-MATH-500), חלון הקשר גדול מאוד, ותמיכה רב-מודלית בטקסט, תמונות, קבצים, אודיו ווידאו.
איך זה משתווה ל-Gemini 2.5 Flash?
Gemini 2.5 Flash Lite זול ומהיר יותר, אך סביר להניח שיש לו ביצועים מעט נמוכים יותר בהיגיון מורכב, כתיבה יצירתית ויצירת קוד בהשוואה למודל Flash המלא.
האם OrcaRouter מאחסן או משתף את הנתונים שלי בעת שימוש במודל זה?
העובדות שסופקו אינן מפרטות את מדיניות הטיפול בנתונים של OrcaRouter. בדרך כלל, ספקי API עשויים לעבד נתונים רק לצורך מימוש בקשות. בדוק את מדיניות הפרטיות של OrcaRouter לפרטים.
כיצד ניתן לקרוא למודל זה באמצעות API תואם ל-OpenAI?
השתמש בכתובת הבסיס https://api.orcarouter.ai/v1 עם מזהה המודל "google/gemini-2.5-flash-lite" בספריית הלקוח של OpenAI שלך. כלול את מפתח ה-API של OrcaRouter שלך בכותרת ה-Authorization.
האם אוכל להשתמש בקלטים מולטי-מודליים כמו תמונות ואודיו?
כן, המודל מקבל קלטים של טקסט, תמונה, קובץ, אודיו ווידאו. אתה יכול לכלול אותם כחלקי תוכן בהודעת המשתמש באמצעות הפורמט הרב-מודאלי הסטנדרטי של OpenAI.
מהי ההשהייה הצפויה?
המודל מתוכנן לזמן השהייה נמוך (latency), במיוחד בהשוואה למודלים גדולים יותר. הזמנים המדויקים תלויים באורך הקלט/פלט ובעומס השרת. לא מסופקים נתוני השהייה ספציפיים.
אילו שפות תכנות ופריימוורקים נתמכים?
כל שפה שתומכת בבקשות HTTP ובפורמט ה-API של OpenAI (Python, JavaScript, Go, Java, וכו') יכולה לשמש. הספרייה הרשמית של OpenAI ל-Python פועלת בצורה חלקה.
האם OrcaRouter מציעה מטמון או הנחות לנפח גבוה?
לא סופק מידע על שמירה במטמון או הנחת נפח. התמחור הוא לפי אסימון בתעריפי הספק ללא תוספת מחיר. צרו קשר עם OrcaRouter לפניות ארגוניות.

הטמעת התג הזה

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite ב-OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

כרטיס מודל כנתונים

GET /api/public/models/google/gemini-2.5-flash-liteפתיחה
קריא למכונה:/llms.txt/llms-full.txt