Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
ビジョン音声ツールJSON推論
提供 Google · 2025-07-22

Gemini 2.5 Flash-Liteは、Gemini 2.5ファミリーに属する軽量推論モデルで、超低遅延とコスト効率に最適化されています。スループットの向上、より高速なトークン生成、より優れたパフォーマンスを提供します...

コンテキスト1M トークン
最大出力65K
入力text + image + file + audio + video
出力text
p50 TTFT1.34 s
入力$0.10/ 100万 tokens
出力$0.40/ 100万 tokens
p50 TTFT1.34 s7日
p95 TTFT8.52 s7日
トラフィック11.3Mtokens / 7日

Google Gemini 2.5 Flash Liteは、GoogleのGemini 2.5 Flashモデルよりも小型で高速、かつ低コストなバリアントです。テキスト、画像、ファイル、音声、動画など、幅広いマルチモーダル入力を処理できるように設計されており、1,048,576トークンの大規模なコンテキストウィンドウを維持します。最大出力は65,536トークンで、1回のターンで長文コンテンツの生成…

Google Gemini 2.5 Flash Liteとは何ですか?

このモデルは誰が使用すべきですか?

どの入力方式に対応していますか?

他のGoogleモデルと比べてどうですか?

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • include_reasoning
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

料金

入力 / 1M tokens$0.100
出力 / 1M tokens$0.400
キャッシュ読み取り / 1M$0.010
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $1.90 · プロンプトキャッシュ利用時 $1.59

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000201

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
1.34 s
出力速度
541 tok/s
p95 TTFT
8.52 s
エラー率
0.44%

公開ベンチマーク

7.4
AA Coding
比較対象モデルの 1% を上回る
126 中 125 位
6.7
AA Intelligence
比較対象モデルの 3% を上回る
128 中 122 位
35.3
AA Math
比較対象モデルの 12% を上回る
81 中 71 位
AIME
50.0
AIME 2025
35.3
GPQA Diamond
47.4
Humanity's Last Exam
3.7
IFBench
31.5
LiveCodeBench
40.0
Long-Context Recall
32.0
MATH-500
92.6
MMLU-Pro
72.4
SciCode
17.7
TerminalBench Hard
2.3
τ²-Bench
19.0
ソース: artificialanalysis.ai

コミュニティの話題

今週の開発者の声

Hacker News0 件の言及 · 7日間先週比 1 減少

比較

Gemini 2.5 Flash LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
入力 $/100万$0.10$2.00$4.00$0.50
出力 $/100万$0.40$12.00$18.00$3.00
コンテキスト1.0M1.0M1.0M1.0M
品質2/1010/1010/109/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

OrcaRouter上でのGemini 2.5 Flash Liteのトークンあたりのコストはいくらですか?
入力トークンは100万トークンあたり0.10ドル、出力トークンは100万トークンあたり0.40ドルです。OrcaRouterはプロバイダーのレートで請求し、マークアップはゼロです。
コンテキストウィンドウサイズとは何ですか?
コンテキストウィンドウは1,048,576トークン(100万トークン)で、最大出力は65,536トークンです。
モデルの主な強みは何ですか?
長所は、低コスト、高速、強力な数学的推論能力(MATH-500で92.6)、非常に大きなコンテキストウィンドウ、そしてテキスト、画像、ファイル、音声、動画に対応したマルチモーダルサポートです。
Gemini 2.5 Flashと比較してどうですか?
Gemini 2.5 Flash Lite はより安価で高速ですが、完全な Flash モデルと比較して、複雑な推論、創造的な文章作成、およびコード生成においてパフォーマンスがやや低い可能性があります。
OrcaRouterは、このモデルを使用する際に、私のデータを保存または共有しますか?
提供された事実はOrcaRouterのデータ処理ポリシーを特定していません。通常、APIプロバイダーはリクエストを処理するためだけにデータを処理する場合があります。詳細についてはOrcaRouterのプライバシーポリシーを確認してください。
このモデルをOpenAI互換のAPI経由で呼び出すにはどうすればよいですか?
OpenAIクライアントライブラリで、ベースURLとして https://api.orcarouter.ai/v1 を、モデルIDとして "google/gemini-2.5-flash-lite" を使用してください。認証ヘッダーにOrcaRouter APIキーを含めてください。
画像や音声のようなマルチモーダル入力を使用できますか?
はい、このモデルはテキスト、画像、ファイル、音声、動画の入力をサポートしています。これらは、標準のOpenAIマルチモーダル形式を使用して、ユーザーメッセージのコンテンツ部分として含めることができます。
予想されるレイテンシはどのくらいですか?
このモデルは低レイテンシ向けに設計されており、特に大規模モデルと比較してその特性が顕著です。正確な時間は入力/出力の長さとサーバーの負荷に依存します。具体的なレイテンシ数値は提供されていません。
サポートされているプログラミング言語とフレームワークは何ですか?
HTTPリクエストとOpenAI API形式(Python、JavaScript、Go、Javaなど)をサポートする任意の言語を使用できます。公式のOpenAI Pythonライブラリはシームレスに動作します。
OrcaRouterは、大量利用向けのキャッシングや割引を提供していますか?
キャッシングやボリュームディスカウントに関する情報は提供されていません。価格はトークン単位で、プロバイダーのレートに基づき、マークアップはありません。エンタープライズに関するお問い合わせはOrcaRouterまでご連絡ください。

このバッジを埋め込む

Google: Gemini 2.5 Flash Lite$0.10/M in1337ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg" alt="OrcaRouter の Google: Gemini 2.5 Flash Lite" /> </a>
Markdown [![Google: Gemini 2.5 Flash Lite](https://www.orcarouter.ai/embed/google/gemini-2.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-2.5-flash-lite)

モデルカードをデータで取得

GET /api/public/models/google/gemini-2.5-flash-lite開く