Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
Thị giácÂm thanhCông cụJSONSuy luận
bởi Google · 2025-07-22

Gemini 2.5 Flash-Lite là một mô hình lý luận nhẹ trong gia đình Gemini 2.5, được tối ưu hóa cho độ trễ cực thấp và hiệu quả chi phí. Nó cung cấp thông lượng cải thiện, tạo token nhanh hơn và hiệu suất tốt hơn...

ngữ cảnh1M token
Đầu ra tối đa65K
Đầu vàotext + image + file + audio + video
Đầu ratext
TTFT p501.34 s
ĐẦU VÀO$0.10/ 1M token
ĐẦU RA$0.40/ 1M token
TTFT p501.34 s7 ngày
p95 TTFT8.52 s7 ngày
LƯU LƯỢNG11.3Mtokens / 7 ngày

Google Gemini 2.5 Flash Lite là một biến thể nhỏ hơn, nhanh hơn và giá phải chăng hơn của mô hình Gemini 2.5 Flash từ Google. Mô hình này được thiết kế để xử lý nhiều loại đầu vào đa phương thức—bao…

Google Gemini 2.5 Flash Lite là gì?

Ai nên sử dụng mô hình này?

Nó hỗ trợ những phương thức đầu vào nào?

Nó so sánh như thế nào với các mô hình Google khác?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Giá

Đầu vào / 1M tokens$0.100
Đầu ra / 1M tokens$0.400
Đọc cache / 1M$0.010
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $1.90 · Có cache prompt $1.59

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000202

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
1.34 s
Tốc độ đầu ra
541 tok/s
p95 TTFT
8.52 s
Tỷ lệ lỗi
0.44%

Benchmark công khai

7.4
AA Coding
Tốt hơn 1% số mô hình được so sánh
#125 / 126
6.7
AA Intelligence
Tốt hơn 3% số mô hình được so sánh
#122 / 128
35.3
AA Math
Tốt hơn 12% số mô hình được so sánh
#71 / 81
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
Nguồn: artificialanalysis.ai

Thảo luận cộng đồng

Điều các nhà phát triển đang nói tuần này

Hacker News0 lượt nhắc · 7 ngàygiảm 1 so với tuần trước

So sánh

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Đầu vào $/M$0.10$2.00$4.00$0.50
Đầu ra $/M$0.40$12.00$18.00$3.00
Ngữ cảnh1.0M1.0M1.0M1.0M
Chất lượng2/1010/1010/109/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí mỗi token cho Gemini 2.5 Flash Lite trên OrcaRouter là bao nhiêu?
Chi phí token đầu vào là $0.10 cho mỗi 1 triệu token, token đầu ra là $0.40 cho mỗi 1 triệu token. OrcaRouter tính phí theo giá của nhà cung cấp, không có phụ phí.
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Cửa sổ ngữ cảnh là 1.048.576 token (1 triệu token) và đầu ra tối đa là 65.536 token.
Những điểm mạnh chính của mô hình là gì?
Các điểm mạnh bao gồm chi phí thấp, tốc độ cao, khả năng suy luận toán học mạnh mẽ (92.6 trên MATH-500), cửa sổ ngữ cảnh rất lớn và hỗ trợ đa phương thức cho văn bản, hình ảnh, tệp tin, âm thanh và video.
Nó so sánh thế nào với Gemini 2.5 Flash?
Gemini 2.5 Flash Lite rẻ hơn và nhanh hơn, nhưng có thể có hiệu suất thấp hơn một chút trong các tác vụ suy luận phức tạp, viết sáng tạo và sinh mã so với mô hình Flash đầy đủ.
OrcaRouter có lưu trữ hoặc chia sẻ dữ liệu của tôi khi sử dụng mô hình này không?
Các thông tin được cung cấp không nêu rõ chính sách xử lý dữ liệu của OrcaRouter. Thông thường, các nhà cung cấp API chỉ có thể xử lý dữ liệu để hoàn thành các yêu cầu. Hãy kiểm tra chính sách bảo mật của OrcaRouter để biết chi tiết.
Làm thế nào để gọi mô hình này thông qua API tương thích với OpenAI?
Sử dụng URL cơ sở https://api.orcarouter.ai/v1 với id mô hình "google/gemini-2.5-flash-lite" trong thư viện OpenAI client của bạn. Bao gồm khóa API OrcaRouter của bạn trong tiêu đề Authorization.
Tôi có thể sử dụng đầu vào đa phương thức như hình ảnh và âm thanh không?
Có, mô hình chấp nhận đầu vào là văn bản, hình ảnh, tệp, âm thanh và video. Bạn có thể đưa chúng vào như các phần nội dung trong tin nhắn người dùng bằng cách sử dụng định dạng đa phương thức tiêu chuẩn của OpenAI.
Độ trễ dự kiến là bao nhiêu?
Mô hình được thiết kế để có độ trễ thấp, đặc biệt khi so với các mô hình lớn hơn. Thời gian chính xác phụ thuộc vào độ dài đầu vào/đầu ra và tải của máy chủ. Không có số liệu độ trễ cụ thể nào được cung cấp.
Ngôn ngữ lập trình và framework nào được hỗ trợ?
Bất kỳ ngôn ngữ nào hỗ trợ yêu cầu HTTP và định dạng API của OpenAI (Python, JavaScript, Go, Java, v.v.) đều có thể được sử dụng. Thư viện Python chính thức của OpenAI hoạt động mượt mà.
OrcaRouter có cung cấp tính năng caching hoặc giảm giá cho khối lượng lớn không?
Không có thông tin về bộ nhớ đệm hoặc chiết khấu theo khối lượng được cung cấp. Giá được tính theo token với tỷ lệ của nhà cung cấp, không có phụ phí. Liên hệ OrcaRouter để được tư vấn doanh nghiệp.

Nhúng huy hiệu này

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="Google: Gemini 2.5 Flash Lite trên OrcaRouter" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/google/gemini-2.5-flash-liteMở
Máy đọc được:/llms.txt/llms-full.txt