Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
การมองเห็นเสียงเครื่องมือJSONการให้เหตุผล
โดย Google · 2025-07-22

Gemini 2.5 Flash-Lite เป็นโมเดลการให้เหตุผลแบบน้ำหนักเบาในตระกูล Gemini 2.5 ที่ได้รับการปรับให้เหมาะสมเพื่อความหน่วงต่ำเป็นพิเศษและประสิทธิภาพด้านต้นทุน โดยมอบปริมาณงานที่เพิ่มขึ้น การสร้างโทเค็นที่เร็วกว่า และประสิทธิภาพที่ดีกว่า...

ctx1M โทเค็น
เอาต์พุตสูงสุด65K
อินพุตtext + image + file + audio + video
เอาต์พุตtext
p50 TTFT1.34 s
INPUT$0.10/ 1M โทเค็น
OUTPUT$0.40/ 1M โทเค็น
p50 TTFT1.34 s7 วัน
p95 TTFT8.52 s7 วัน
ทราฟฟิก11.3Mโทเค็น / 7วัน
รับ API ของ Gemini 2.5 Flash Lite ลองใน playground</> ใช้ผ่าน API

Google Gemini 2.5 Flash Lite เป็นรุ่นที่เล็กกว่า เร็วกว่า และมีราคาถูกกว่าของโมเดล Gemini 2.5 Flash จาก Google มันถูกออกแบบมาเพื่อรองรับอินพุตแบบมัลติโมดัลที่หลากหลาย—รวมถึงข้อความ รูปภาพ ไฟล์ เสียง…

Google Gemini 2.5 Flash Lite คืออะไร

ใครควรใช้โมเดลนี้

มันรองรับรูปแบบการป้อนข้อมูลใดบ้าง?

มันเทียบกับโมเดลอื่นๆ ของ Google ได้อย่างไร

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

ราคา

อินพุต / 1M โทเค็น$0.100
เอาต์พุต / 1M โทเค็น$0.400
อ่านแคช / 1M$0.010
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $1.90 · เมื่อใช้แคชพรอมป์ต์ $1.59

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.000201

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
1.34 s
ความเร็วเอาต์พุต
541 tok/s
p95 TTFT
8.52 s
อัตราข้อผิดพลาด
0.44%

เกณฑ์มาตรฐานสาธารณะ

7.4
AA Coding
ดีกว่า 1% ของโมเดลที่เปรียบเทียบ
อันดับ 125 จาก 126
6.7
AA Intelligence
ดีกว่า 3% ของโมเดลที่เปรียบเทียบ
อันดับ 122 จาก 128
35.3
AA Math
ดีกว่า 12% ของโมเดลที่เปรียบเทียบ
อันดับ 71 จาก 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
แหล่งที่มา: artificialanalysis.ai

กระแสในชุมชน

สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้

Hacker News0 การกล่าวถึง · 7 วันลดลง 1 จากสัปดาห์ก่อน

การเปรียบเทียบ

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
อินพุต $/ล้าน$0.10$2.00$4.00$0.50
เอาต์พุต $/ล้าน$0.40$12.00$18.00$3.00
บริบท1.0M1.0M1.0M1.0M
คุณภาพ2/1010/1010/109/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก Google

FAQ

ราคาต่อโทเคนสำหรับ Gemini 2.5 Flash Lite บน OrcaRouter คือเท่าไหร่?
ค่าใช้จ่ายของ input tokens อยู่ที่ $0.10 ต่อ 1 ล้าน tokens, ค่าใช้จ่ายของ output tokens อยู่ที่ $0.40 ต่อ 1 ล้าน tokens. OrcaRouter คิดอัตราตามผู้ให้บริการโดยไม่มีมาร์กอัป
ขนาดหน้าต่างบริบทคือเท่าไร?
หน้าต่างบริบทคือ 1,048,576 โทเค็น (1 ล้านโทเค็น) และผลลัพธ์สูงสุดคือ 65,536 โทเค็น
จุดแข็งหลักของแบบจำลองคืออะไร?
จุดแข็งรวมถึงต้นทุนต่ำ ความเร็วสูง ความสามารถในการให้เหตุผลทางคณิตศาสตร์ที่แข็งแกร่ง (92.6 บน MATH-500) หน้าต่างบริบทที่ใหญ่มาก และการรองรับมัลติโมดอลสำหรับข้อความ รูปภาพ ไฟล์ เสียง และวิดีโอ
มันเทียบกับ Gemini 2.5 Flash ได้อย่างไร
Gemini 2.5 Flash Lite มีราคาถูกกว่าและเร็วกว่า แต่ประสิทธิภาพในการใช้เหตุผลซับซ้อน การเขียนเชิงสร้างสรรค์ และการสร้างโค้ดอาจต่ำกว่าเมื่อเทียบกับโมเดล Flash เต็มรูปแบบ
OrcaRouter เก็บหรือแบ่งปันข้อมูลของฉันเมื่อใช้โมเดลนี้หรือไม่?
ข้อเท็จจริงที่ระบุไม่ได้ระบุถึงนโยบายการจัดการข้อมูลของ OrcaRouter โดยทั่วไป ผู้ให้บริการ API อาจประมวลผลข้อมูลเพื่อตอบสนองคำขอเท่านั้น โปรดตรวจสอบนโยบายความเป็นส่วนตัวของ OrcaRouter สำหรับรายละเอียด
ฉันจะเรียกใช้โมเดลนี้ผ่าน API ที่เข้ากันได้กับ OpenAI ได้อย่างไร
ใช้ base URL https://api.orcarouter.ai/v1 พร้อมกับ model id "google/gemini-2.5-flash-lite" ในไลบรารีของไคลเอนต์ OpenAI ของคุณ รวมถึง OrcaRouter API key ของคุณในส่วนหัว Authorization
ฉันสามารถใช้อินพุตแบบหลายรูปแบบ เช่น รูปภาพและเสียงได้หรือไม่?
ใช่ โมเดลยอมรับอินพุตที่เป็นข้อความ รูปภาพ ไฟล์ เสียง และวิดีโอ คุณสามารถรวมสิ่งเหล่านี้เป็นส่วนหนึ่งของเนื้อหาในข้อความผู้ใช้โดยใช้รูปแบบ multimodal มาตรฐานของ OpenAI
เวลาแฝงที่คาดหวังคือเท่าไหร่?
โมเดลนี้ถูกออกแบบมาเพื่อความหน่วงต่ำ โดยเฉพาะเมื่อเทียบกับโมเดลขนาดใหญ่ เวลาที่แน่นอนขึ้นอยู่กับความยาวของอินพุต/เอาต์พุตและโหลดของเซิร์ฟเวอร์ ไม่มีการระบุค่าความหน่วงที่เฉพาะเจาะจง
รองรับภาษาโปรแกรมและเฟรมเวิร์กใดบ้าง
ภาษาที่รองรับคำขอ HTTP และรูปแบบ API ของ OpenAI (Python, JavaScript, Go, Java ฯลฯ) สามารถใช้งานได้ โดยไลบรารี Python อย่างเป็นทางการของ OpenAI ทำงานได้อย่างราบรื่น
OrcaRouter มีการแคชหรือส่วนลดสำหรับการใช้งานปริมาณสูงหรือไม่?
ไม่มีข้อมูลเกี่ยวกับการแคชหรือส่วนลดปริมาณการใช้งาน ราคาจะคิดตามจำนวนโทเค็นในอัตราของผู้ให้บริการโดยไม่มีมาร์กอัป ติดต่อ OrcaRouter สำหรับสอบถามข้อมูลองค์กร

ฝังป้ายนี้

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite บน OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

ข้อมูลโมเดลแบบ data

GET /api/public/models/google/gemini-2.5-flash-liteเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt