Gemini 2.5 Flash

google/gemini-2.5-flash
비전오디오도구JSON추론
제공 Google · 2025-06-17

Gemini 2.5 Flash는 구글의 최첨단 작업용 모델로, 고급 추론, 코딩, 수학 및 과학 작업을 위해 특별히 설계되었습니다. 여기에는 내장된 "사고" 기능이 포함되어 있어 더 큰...

컨텍스트1.05M 토큰
최대 출력65.5K
입력file + image + text + audio + video
출력text
p50 TTFT10.00 s
입력$0.30/ 100만 토큰
출력$2.50/ 100만 토큰
p50 TTFT10.00 s7일
p95 TTFT10.00 s7일
트래픽433.8K토큰 / 7일

Google Gemini 2.5 Flash는 Google이 개발한 멀티모달 언어 모델입니다. Gemini 2.5 시리즈에 속하며, 텍스트, 이미지, 오디오, 비디오 입력을 효율적으로 처리하도록 설계되었습니다. 이 모델은 1,048,576개의 토큰 컨텍스트 윈도우를 지원하여 매우 긴 문서나 여러 파일에 걸친 대화를 처리할 수 있습니다. 출력 길이는 최대…

Google Gemini 2.5 Flash란 무엇인가요?

누가 Gemini 2.5 Flash를 사용해야 하나요?

Gemini 2.5 Flash의 주요 사양은 무엇인가요?

Gemini 2.5 Flash는 다른 Gemini 모델들과 어떻게 다른가요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

가격

입력 / 1M tokens$0.300
출력 / 1M tokens$2.50
캐시 읽기 / 1M$0.030
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $9.60 · 프롬프트 캐싱 사용 시 $8.66

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.001253

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
10.00 s
출력 속도
1247 tok/s
p95 TTFT
10.00 s
오류율
2.3%

공개 벤치마크

17.8
AA Coding
비교된 모델 중 15%보다 우수
123개 중 105위
14.1
AA Intelligence
비교된 모델 중 14%보다 우수
125개 중 107위
60.3
AA Math
비교된 모델 중 44%보다 우수
81개 중 45위
AIME
50.0
AIME 2025
60.3
GPQA Diamond
68.3
Humanity's Last Exam
5.1
IFBench
39.0
LiveCodeBench
49.5
Long-Context Recall
45.9
MATH-500
93.2
MMLU-Pro
80.9
SciCode
29.1
TerminalBench Hard
12.1
τ²-Bench
14.9
소스: artificialanalysis.ai

비교

Gemini 2.5 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
입력 $/100만$0.30$2.00$4.00$0.50
출력 $/100만$2.50$12.00$18.00$3.00
컨텍스트1.0M1.0M1.0M1.0M
품질3/1010/1010/109/10
나란히 비교나란히 비교나란히 비교나란히 비교

Google의 다른 모델

FAQ

토큰당 Gemini 2.5 Flash의 비용은 얼마인가요?
입력은 1백만 토큰당 $0.30, 출력은 1백만 토큰당 $2.50입니다. 이는 OrcaRouter를 통해 마크업 없는 Google의 제공업체 요금입니다.
Gemini 2.5 Flash의 컨텍스트 윈도우 크기는 몇인가요?
컨텍스트 윈도우는 1,048,576 토큰(1M 토큰)입니다. 최대 출력은 65,536 토큰입니다.
Gemini 2.5 Flash의 주요 강점은 무엇인가요?
MATH-500 점수 93.2를 달성하여 강력한 수학적 추론 능력을 입증합니다. 또한 여러 입력 형식(파일, 이미지, 텍스트, 오디오, 비디오)을 지원하며 매우 큰 컨텍스트 윈도우를 경쟁력 있는 가격에 제공합니다.
Gemini 2.5 Flash와 Gemini 2.0 Flash는 어떻게 비교되나요?
Gemini 2.5 Flash는 더 비싸지만 수학 성능이 향상되었습니다 (MATH-500에서 93.2 대비 낮은 점수). 둘 다 1M 컨텍스트 윈도우를 가지고 있습니다. 2.0 Flash는 1M 토큰당 $0.15/$0.60이고, 2.5 Flash는 $0.30/$2.50입니다.
OrcaRouter가 모델 가격에 마크업을 추가하나요?
아니요, OrcaRouter는 정확한 공급자 요율로 청구하며 마크업이 없습니다. 1M 입력당 $0.30, 1M 출력 토큰당 $2.50를 지불합니다.
Gemini 2.5 Flash를 OpenAI 호환 API를 통해 사용할 수 있나요?
네. 기본 URL https://api.orcarouter.ai/v1과 모델 ID "google/gemini-2.5-flash"를 사용하세요. 모든 OpenAI SDK와 HTTP 클라이언트는 표준 채팅 완료 매개변수와 함께 작동합니다.
Gemini 2.5 Flash는 어떤 입력 모드를 지원하나요?
파일, 이미지, 텍스트, 오디오 및 비디오 입력을 지원합니다. 이들을 하나의 요청에서 혼합할 수 있습니다.
OrcaRouter를 통해 Gemini 2.5 Flash를 사용할 때 내 데이터가 어떻게 처리됩니까?
데이터 처리는 Google의 API 개인정보 보호정책 및 OrcaRouter의 이용약관을 따릅니다. Google Cloud 계정을 통해 옵트아웃하지 않는 한 Google은 모델 개선을 위해 데이터를 처리할 수 있습니다. 자세한 내용은 Google의 데이터 처리 문서를 확인하세요.

이 배지 임베드

Google: Gemini 2.5 Flash$0.30/M in10000ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg" alt="OrcaRouter 의 Google: Gemini 2.5 Flash" /> </a>
Markdown [![Google: Gemini 2.5 Flash](https://www.orcarouter.ai/embed/google/gemini-2.5-flash.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash)

모델 카드를 데이터로

GET /api/public/models/google/gemini-2.5-flash열기
기계 판독 가능:/llms.txt/llms-full.txt