Gemini 3.5 Flash-Lite

google/gemini-3.5-flash-lite
ใหม่แนะนำ
การมองเห็นเสียงเครื่องมือJSONการให้เหตุผล
โดย Google · 2026-07-21

Gemini 3.5 Flash-Lite เป็นโมเดล Gemini ที่คุ้มค่าที่สุดของ Google ออกแบบมาโดยเฉพาะสำหรับ workloads ที่มีปริมาณสูงมากและไวต่อเวลาแฝง ซึ่งต้นทุนต่อการเรียกใช้เป็นปัจจัยหลัก แม้จะมีราคาถูก แต่ก็เป็น multimodal โดยธรรมชาติ — รองรับข้อความ รูปภาพ วิดีโอ เสียง และไฟล์พร้อมเอาต์พุตข้อความ — และมีหน้าต่างบริบท 1M-token และเอาต์พุตสูงสุด 64K tokens เช่นเดียวกับ Flash ระดับที่ใหญ่กว่า ดังนั้นเอกสารยาวและอินพุตสื่อผสมยังคงเข้าถึงได้ ด้วยราคาประมาณหนึ่งในห้าของ 3.6 Flash จึงเป็นเครื่องมือที่เหมาะสมสำหรับการจำแนกประเภท การแยกข้อมูล การจัดเส้นทาง การสรุป เอเจนต์น้ำหนักเบา การสร้างข้อมูลสังเคราะห์ และไปป์ไลน์ใดๆ ที่ทำงานนับล้านครั้ง ยังคงรองรับการปรับระดับการใช้เหตุผล การเรียกใช้เครื่องมือแบบดั้งเดิม และเอาต์พุตที่มีโครงสร้าง และทำผลงานดีเกินขนาดในการวัดประสิทธิภาพด้านเอเจนต์และบริบทยาวสำหรับโมเดล Lite — เช่น 74.0% ใน OSWorld-Verified และ 72.2% ในการดึงเข็มหลายเข็มขนาด 128k เหนือกว่า 3.1 Flash-Lite รุ่นก่อนหน้าอย่างสบายๆ รองรับทั้งรูปแบบ chat-completions ของ OpenAI และ API generateContent ดั้งเดิมของ Gemini ดังนั้นคุณสามารถผสมกับโมเดลที่หนักกว่าเบื้องหลังการรวมระบบเดียว — ส่งเส้นทางการรับส่งข้อมูลง่ายและปริมาณสูงไปยัง Flash-Lite และส่งต่องานยากไปยัง 3.6 Flash หรือโมเดล Pro

ctx1.05M โทเค็น
เอาต์พุตสูงสุด65.5K
อินพุตtext + image + video + file + audio
เอาต์พุตtext
p50 TTFT1.30 s
INPUT$0.30/ 1M โทเค็น
OUTPUT$2.50/ 1M โทเค็น
p50 TTFT1.30 s7 วัน
p95 TTFT10.00 s7 วัน
ทราฟฟิก5.9Mโทเค็น / 7วัน
รับ API ของ Gemini 3.5 Flash-Lite ลองใน playground</> ใช้ผ่าน API

Google Gemini 3.5 Flash-Lite เป็นโมเดลภาษาหลายรูปแบบ (multimodal) ที่พัฒนาโดย Google ให้บริการผ่าน API ที่เข้ากันได้กับ OpenAI ของ OrcaRouter รองรับอินพุตทั้งข้อความ รูปภาพ วิดีโอ ไฟล์ และเสียง…

Google Gemini 3.5 Flash-Lite คืออะไร

โมเดลนี้ออกแบบมาเพื่อใคร?

โมเดลรองรับรูปแบบใดบ้าง?

บริบทวินโดว์และเอาต์พุตสูงสุดมีขนาดเท่าใด

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

ราคา

อินพุต / 1M โทเค็น$0.300
เอาต์พุต / 1M โทเค็น$2.50
อ่านแคช / 1M$0.030
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $9.60 · เมื่อใช้แคชพรอมป์ต์ $8.66

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.001254

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
1.30 s
ความเร็วเอาต์พุต
829 tok/s
p95 TTFT
10.00 s
อัตราข้อผิดพลาด
5.0%

เกณฑ์มาตรฐานสาธารณะ

49.3
AA Coding
ดีกว่า 60% ของโมเดลที่เปรียบเทียบ
อันดับ 49 จาก 122
36.5
AA Intelligence
ดีกว่า 54% ของโมเดลที่เปรียบเทียบ
อันดับ 57 จาก 124
CharXiv Reasoning (no tools)
74.5
CharXiv Reasoning (with tools)
76.5
GDM-MRCR v2 8-needle (128k avg)
72.2
GDM-MRCR v2 8-needle (1M pointwise)
21.3
GPQA Diamond
83.8
Humanity's Last Exam
17.5
Long-Context Recall
62.0
MLE-Bench
39.2
OSWorld-Verified
74.0
SciCode
40.9
SWE-Bench Pro (Public)
54.2
tau_banking
16.5
Terminal-bench 2.1 (Terminus-2)
54.0
terminalbench_v2_1
53.6
แหล่งที่มา: artificialanalysis.ai, deepmind.google

การเปรียบเทียบ

Gemini 3.5 Flash-LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
อินพุต $/ล้าน$0.30$2.00$4.00$0.50
เอาต์พุต $/ล้าน$2.50$12.00$18.00$3.00
บริบท1.0M1.0M1.0M1.0M
คุณภาพ6/1010/1010/109/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก Google

FAQ

ราคาต่อโทเคนสำหรับ Gemini 3.5 Flash-Lite บน OrcaRouter คือเท่าไหร่?
ราคาคือ $0.30 ต่อหนึ่งล้านโทเค็นอินพุต และ $2.50 ต่อหนึ่งล้านโทเค็นเอาต์พุต นี่คืออัตราของผู้ให้บริการที่ไม่มีส่วนเพิ่ม โทเค็นอินพุตรวมทุกรูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง, ไฟล์) โทเค็นเอาต์พุตคือข้อความที่ถูกสร้างขึ้น
ขนาดหน้าต่างบริบทคือเท่าไร?
หน้าต่างบริบทมี 1,048,576 โทเคน (ประมาณ 1 ล้าน) ความยาวเอาต์พุตสูงสุดคือ 65,536 โทเคน ซึ่งช่วยให้สามารถจัดการเอกสาร วิดีโอ หรือไฟล์เสียงที่มีความยาวมากในการร้องขอ API เดียวได้
โมเดลนี้มีจุดแข็งสำคัญอะไรบ้าง?
จุดแข็งหลักคือ: ต้นทุนต่อโทเค็นที่ต่ำมาก รองรับรูปแบบอินพุต 5 รูปแบบ (ข้อความ, รูปภาพ, วิดีโอ, เสียง, ไฟล์), หน้าต่างบริบทขนาดใหญ่ 1M, และความสามารถในการใช้เครื่องมือ (คะแนน CharXiv Reasoning 76.5 พร้อมเครื่องมือ) ออกแบบมาสำหรับสายงานการผลิตที่เน้นปริมาณงานสูงและอ่อนไหวต่อต้นทุน
เปรียบเทียบกับโมเดลขนาดใหญ่กว่าเช่น Gemini 3.5 Pro ได้อย่างไร?
ไม่มีการเปรียบเทียบเกณฑ์วัดประสิทธิภาพโดยตรง ในฐานะรุ่นย่อยแบบ flash‑lite โมเดลนี้ให้ความสำคัญกับประสิทธิภาพและต้นทุนต่ำมากกว่าประสิทธิภาพดิบ โมเดลขนาดใหญ่เช่น Gemini 3.5 Pro อาจมีความแม่นยำสูงกว่าในงานที่ใช้เหตุผลซับซ้อน แต่มีต้นทุนต่อโทเคนสูงกว่าอย่างมาก ใช้โมเดลนี้เมื่อต้นทุนและปริมาณงานต่อหน่วยเวลามีความสำคัญ
โมเดลเก็บแคชพรอมต์เพื่อลดต้นทุนหรือไม่?
ข้อมูลที่ให้มาไม่ได้กล่าวถึงกลไกการแคชหรือราคาโทเค็นที่แคชแบบลดราคา คุณควรถือว่าโทเค็นทั้งหมดถูกเรียกเก็บในอัตราค่าป้อนข้อมูลมาตรฐาน หากการแคชเป็นสิ่งสำคัญ ให้ตรวจสอบกับ OrcaRouter หรือ Google สำหรับส่วนลดที่มีให้
ฉันจะเข้าถึงโมเดลนี้ผ่าน API ที่เข้ากันได้กับ OpenAI ได้อย่างไร?
ใช้ API ของ OrcaRouter ที่ URL หลัก https://api.orcarouter.ai/v1 ตั้งค่าพารามิเตอร์ model เป็น "google/gemini-3.5-flash-lite" API นี้เข้ากันได้อย่างสมบูรณ์กับรูปแบบ chat completions ของ OpenAI รวมถึงเนื้อหาหลายรูปแบบ (multimodal content) และคำจำกัดความของเครื่องมือ (tool definitions)
ฉันควรคาดหวังอะไรเกี่ยวกับการจัดการข้อมูลและความเป็นส่วนตัวบ้าง?
การจัดการข้อมูลอยู่ภายใต้นโยบายของ Google (ผู้ให้บริการ) และข้อกำหนดของ OrcaRouter โมเดลจะประมวลผลข้อมูลที่คุณป้อน และส่งผลลัพธ์กลับไปให้คุณ ไม่มีการรับรองความเป็นส่วนตัวเฉพาะสำหรับโมเดลนี้ หากเป็นข้อมูลที่ละเอียดอ่อน โปรดตรวจสอบข้อตกลงการประมวลผลข้อมูลของผู้ให้บริการ
ฉันสามารถใช้โมเดลนี้สำหรับแอปพลิเคชันแบบเรียลไทม์ได้หรือไม่?
ไม่ได้ระบุรายละเอียดเวลาแฝง โมเดลสามารถส่งคืนการตอบสนองในหน่วยวินาทีสำหรับอินพุตสั้น ๆ แต่การประมวลผลพรอมต์ที่ยาวมาก (ใกล้ 1 ล้านโทเค็น) อาจใช้เวลาหลายสิบวินาที เหมาะสำหรับแอปพลิเคชันที่ต้องการความใกล้เคียงเวลาจริงที่มีขนาดอินพุตปานกลาง สำหรับข้อกำหนดเวลาจริงที่เข้มงวด ให้ทดสอบกับความยาวอินพุตที่คุณคาดหวัง
คะแนน CharXiv Reasoning benchmark คือเท่าไหร่?
โมเดลนี้ได้คะแนน 76.5 ในการทดสอบ CharXiv Reasoning with tools การทดสอบนี้วัดความเข้าใจและการใช้เหตุผลเกี่ยวกับแผนภูมิ คะแนนดังกล่าวบ่งชี้ถึงประสิทธิภาพระดับปานกลาง โมเดลสามารถตีความแผนภูมิและตอบคำถามได้ แต่ไม่ถึงระดับของโมเดลที่ออกแบบมาเพื่อการใช้เหตุผลโดยเฉพาะ ไม่มีการให้คะแนนจากการทดสอบอื่น ๆ
มีค่าใช้จ่ายขั้นต่ำหรือข้อผูกมัดในการใช้ OrcaRouter หรือไม่?
OrcaRouter ไม่ได้กำหนดค่าใช้จ่ายรายเดือนขั้นต่ำ คุณจะถูกเรียกเก็บเงินเฉพาะโทเค็นที่คุณใช้ในอัตราของผู้ให้บริการที่ไม่มีการบวกเพิ่ม ไม่มีค่าธรรมเนียมล่วงหน้าหรือสัญญาระยะยาว เพียงลงทะเบียนเพื่อรับคีย์ API และเริ่มส่งคำขอ

ฝังป้ายนี้

Google: Gemini 3.5 Flash-Lite$0.30/M in1298ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg" alt="Google: Gemini 3.5 Flash-Lite บน OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.5 Flash-Lite](https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite)

ข้อมูลโมเดลแบบ data

GET /api/public/models/google/gemini-3.5-flash-liteเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt