Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
비전오디오도구JSON추론
제공 Google · 2025-07-22

Gemini 2.5 Flash-Lite는 Gemini 2.5 제품군의 경량 추론 모델로, 초저지연과 비용 효율성에 최적화되어 있습니다. 향상된 처리량, 더 빠른 토큰 생성, 더 나은 성능을 제공...

컨텍스트1M 토큰
최대 출력65K
입력text + image + file + audio + video
출력text
p50 TTFT1.34 s
입력$0.10/ 100만 토큰
출력$0.40/ 100만 토큰
p50 TTFT1.34 s7일
p95 TTFT8.52 s7일
트래픽11.3M토큰 / 7일

Google Gemini 2.5 Flash Lite는 Google의 Gemini 2.5 Flash 모델의 더 작고, 빠르며, 경제적인 변형입니다. 텍스트, 이미지, 파일, 오디오 및 비디오를 포함한 다양한 멀티모달 입력을 처리할 수 있도록 설계되었으며, 1,048,576개의 토큰이라는 대규모 컨텍스트 윈도우를 유지합니다. 최대 65,536개의 토큰을…

Google Gemini 2.5 Flash Lite는 무엇인가요?

이 모델은 누가 사용해야 하나요?

어떤 입력 방식을 지원하나요?

다른 Google 모델들과 비교하면 어떻습니까?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

가격

입력 / 1M tokens$0.100
출력 / 1M tokens$0.400
캐시 읽기 / 1M$0.010
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $1.90 · 프롬프트 캐싱 사용 시 $1.59

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000201

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
1.34 s
출력 속도
541 tok/s
p95 TTFT
8.52 s
오류율
0.44%

공개 벤치마크

7.4
AA Coding
비교된 모델 중 1%보다 우수
126개 중 125위
6.7
AA Intelligence
비교된 모델 중 3%보다 우수
128개 중 122위
35.3
AA Math
비교된 모델 중 12%보다 우수
81개 중 71위
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
소스: artificialanalysis.ai

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News0 회 언급 · 7일지난주 대비 1 감소

비교

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
입력 $/100만$0.10$2.00$4.00$0.50
출력 $/100만$0.40$12.00$18.00$3.00
컨텍스트1.0M1.0M1.0M1.0M
품질2/1010/1010/109/10
나란히 비교나란히 비교나란히 비교나란히 비교

Google의 다른 모델

FAQ

OrcaRouter에서 Gemini 2.5 Flash Lite의 토큰당 비용은 얼마인가요?
입력 토큰은 100만 개당 $0.10, 출력 토큰은 100만 개당 $0.40입니다. OrcaRouter는 제공업체 요율로 청구하며 마크업이 없습니다.
컨텍스트 윈도우 크기는 얼마인가요?
컨텍스트 창은 1,048,576개의 토큰(1백만 토큰)이며, 최대 출력은 65,536개의 토큰입니다.
모델의 주요 장점은 무엇인가요?
장점으로는 저렴한 비용, 빠른 속도, 강력한 수학 추론 능력(MATH-500에서 92.6점), 매우 큰 컨텍스트 윈도우, 그리고 텍스트, 이미지, 파일, 오디오, 비디오를 지원하는 멀티모달 기능이 있습니다.
Gemini 2.5 Flash와 비교하면 어떤가요?
Gemini 2.5 Flash Lite는 더 저렴하고 빠르지만, 전체 Flash 모델에 비해 복잡한 추론, 창의적 글쓰기, 코드 생성 성능이 약간 낮을 가능성이 있습니다.
OrcaRouter는 이 모델을 사용할 때 내 데이터를 저장하거나 공유하나요?
제공된 사실들은 OrcaRouter의 데이터 처리 정책을 명시하지 않습니다. 일반적으로 API 제공자는 요청을 이행하기 위해서만 데이터를 처리할 수 있습니다. 자세한 내용은 OrcaRouter의 개인정보 처리방침을 확인하십시오.
이 모델을 OpenAI-compatible API를 통해 어떻게 호출하나요?
기본 URL https://api.orcarouter.ai/v1과 모델 ID "google/gemini-2.5-flash-lite"를 OpenAI 클라이언트 라이브러리에서 사용하세요. Authorization 헤더에 OrcaRouter API 키를 포함시키세요.
이미지와 오디오 같은 멀티모달 입력을 사용할 수 있나요?
네, 모델은 텍스트, 이미지, 파일, 오디오 및 비디오 입력을 허용합니다. 표준 OpenAI 멀티모달 형식을 사용하여 사용자 메시지의 콘텐츠 부분에 이를 포함할 수 있습니다.
예상 지연 시간은 얼마입니까?
이 모델은 특히 더 큰 모델과 비교하여 낮은 지연 시간을 위해 설계되었습니다. 정확한 시간은 입력/출력 길이와 서버 부하에 따라 다릅니다. 특정 지연 시간 수치는 제공되지 않습니다.
어떤 프로그래밍 언어와 프레임워크가 지원되나요?
HTTP 요청과 OpenAI API 형식을 지원하는 모든 언어(Python, JavaScript, Go, Java 등)를 사용할 수 있습니다. 공식 OpenAI Python 라이브러리는 완벽하게 작동합니다.
OrcaRouter는 대량 사용에 대한 캐싱이나 할인을 제공하나요?
캐싱 또는 볼륨 할인 정보는 제공되지 않았습니다. 가격은 마크업 없이 제공업체 요율에 따라 토큰당 책정됩니다. 기업 문의는 OrcaRouter에 연락하십시오.

이 배지 임베드

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="OrcaRouter 의 Google: Gemini 2.5 Flash Lite" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

모델 카드를 데이터로

GET /api/public/models/google/gemini-2.5-flash-lite열기
기계 판독 가능:/llms.txt/llms-full.txt