Gemini 2.5 Flash Lite vs Gemini 3.5 Flash 比較:ベンチマーク・料金・速度(2026年8月)

OrcaRouter 上で Gemini 2.5 Flash Lite(google)と Gemini 3.5 Flash(google)を直接比較——価格、コンテキストウィンドウ、レイテンシ、スループット、benchmark 品質を並べて示し、ワークロードに最適なモデルを選べます。

Gemini 2.5 Flash Lite と Gemini 3.5 Flash はいずれも同じ OrcaRouter エンドポイント経由でプロバイダー原価・token 加算ゼロで利用できるため、両者の切り替えは 1 行の変更で済み、以下の数値がそのまま実際の支払額になります。この比較はライブ料金、公表されている context window、そして OrcaRouter 自身が測定した latency と throughput を取得しており、ベンダーの宣伝用 benchmark に頼るのではなく、あなた固有のワークロードに対してコストとパフォーマンスを比較検討できます。適切な選択はほぼ常にトラフィックの形——プロンプト長、生成するテキスト量、ユーザーがどれだけ latency に敏感か、そして推論の難しさ——に左右されるため、以下のセクションでは 1 つの次元ずつこの判断を分解し、具体的な推奨で締めくくります。二つのモデルのいずれかで指標が欠けている場合、その行は推測せずに省いてあるので、ここでのすべての主張は実際の数値に裏づけられています。

ひと目で比較

  • 入力 $/100万$0.10Gemini 2.5 Flash Lite 93%
  • p50 レイテンシ1332 msGemini 2.5 Flash Lite 75%
  • 品質9.0Gemini 3.5 Flash 350%

実測:Gemini 2.5 Flash Lite vs Gemini 3.5 Flash バトルモード

バトルモード — 両方を並べて試すライブ
プレイグラウンドで開く
Google: Gemini 2.5 Flash Lite
$0.10 /M · p50 1332ms
Gemini 3.5 Flash
$1.50 /M · p50 5303ms

モデル比較

Gemini 2.5 Flash Lite と Gemini 3.5 Flash の価格、コンテキスト、レイテンシ、スループット、品質。
指標Gemini 2.5 Flash LiteGemini 3.5 Flash結論
入力 $/100万$0.10$1.50入力 tokens では、Gemini 2.5 Flash Lite は Gemini 3.5 Flash より 93% 安価です。
出力 $/100万$0.40$9.00出力 tokens では、Gemini 2.5 Flash Lite は Gemini 3.5 Flash より 96% 安価です。
コンテキスト1M1MGemini 2.5 Flash Lite と Gemini 3.5 Flash は同じコンテキストウィンドウを持ちます。
p50 レイテンシ1332 ms5303 ms中央値で、Gemini 2.5 Flash Lite は Gemini 3.5 Flash より 75% 速く応答します。
スループット529 tok/s960 tok/sGemini 3.5 Flash は Gemini 2.5 Flash Lite より 81% 速く tokens をストリーミングします。
品質2.09.0総合品質指数で、Gemini 3.5 Flash は Gemini 2.5 Flash Lite より 350% 高いスコアです。

価格面では Gemini 2.5 Flash Lite の方が安価で——入力 tokens で Gemini 3.5 Flash より約 93% 低いです。 レイテンシに敏感なワークロードでは、Gemini 2.5 Flash Lite の方が最初の token を早く返します。 benchmark 品質では、Gemini 3.5 Flash が総合指数で先行します。 コストを最小化するなら Gemini 2.5 Flash Lite を、応答速度が最も重要なら Gemini 2.5 Flash Lite を選んでください。

料金とコスト分析

入力 token では Gemini 2.5 Flash Lite が 100 万あたり $0.10、Gemini 3.5 Flash が $1.50、出力では 100 万あたり $0.40 対 $9.00 です。請求額はたいてい出力 token で決まります。長い応答を生成するチャットや agent のワークロードは出力レートに支配されるため、入力では安く見えるモデルでも、エンドツーエンドではより高くつくことがあります。価格だけで選ぶ前に、実際の入力対出力の比率を見積もってください。検索が多く回答が短いプロンプトと、プロンプトが短く生成が長いケースは、この表の正反対に位置します。実用的な見積もり方法は、代表的なプロンプトのサンプルを取り、平均の入力・出力 token を数え、それぞれを両モデルの各レートに掛けることです。あなたの実際のミックスで blended(混合)コストが低いモデルこそ、超えるべき基準です。ここでの両価格は生のプロバイダーレート——OrcaRouter は一切加算しません——なので比較は同一基準であり、計算した節約はそのまま手元に残る節約です。

Gemini 2.5 Flash Lite は最大 1M token の context を受け付け、Gemini 3.5 Flash は 1M を受け付けます。context window は、単一リクエストで送信できるソース素材——ドキュメント、コード、これまでの会話——の量の上限を定めます。ウィンドウが大きいほど長い入力のチャンク分割や検索の配管を省けますが、送信した分はすべて入力 token レートで課金されるため、大きなウィンドウは割引ではなく能力です。ページ上の最大の数値ではなく、ワークロードが現実的に生み出す最長の単一リクエストにウィンドウを合わせてください。また、どのモデルでも非常に長い context の終盤では品質が低下しうることを念頭に置いてください。大きなウィンドウは、あらゆるリクエストを上限まで詰め込む免罪符ではなく、たまに来る長い入力への余裕として扱うのが最善です。

トークン単価の比較

入力 $/100万
Gemini 2.5 Flash Lite$0.10
Gemini 3.5 Flash$1.50
出力 $/100万
Gemini 2.5 Flash Lite$0.40
Gemini 3.5 Flash$9.00

100万 tokens あたり

速度とレイテンシ

latency と throughput は、本番環境でのモデルの体感を左右します。中央値(p50)の応答 latency は、典型的なリクエストが最初の token を受け取るまでの待ち時間であり、throughput(1 秒あたりの token 数)は開始後に応答がストリーミングされる速さを決めます。対話型チャットや agent ループでは、ユーザーが最初の token を待っているため低い p50 latency が最も重要です。バッチ生成や長文出力では、応答が長いため throughput が全体の所要時間を支配します。上の 7 日間トレンドチャートは、各モデルの latency が安定しているか変動しているかを示し、単一の宣伝数値では隠れてしまう点を明らかにします——平均は優秀でもテールがばらつくモデルは、厳格な p95 SLA を満たせないことがあります。製品に latency の予算があるなら、中央値と曲線の形の両方を読み、エンドツーエンドの latency にはネットワークのホップや、モデルの周りで行う検索・ツール呼び出しも含まれることを忘れないでください。

過去7日間で、Gemini 2.5 Flash Lite の方が中央値応答レイテンシが低く保たれています。

Gemini 2.5 Flash Lite
Gemini 3.5 Flash

ベンチマークと品質

benchmark スコアは能力を近似しますが、自分のプロンプトでのテストの代わりにはなりません。ここに表示される総合品質指数は複数の公開評価を集約したもので、パーセンタイルは各モデルがカタログ内の比較可能な全モデルの中でどこに位置するかを示します——有用な絞り込みの目安であり、あなたのタスクでの保証ではありません。汎用知能指数で先行するモデルでも、あなたの領域(コーディング、抽出、多言語、長 context 推論)では劣ることがあります。benchmark で候補を絞り込んだうえで、代表的なトラフィックの一部で両モデルを実際に走らせてください。トップラインの数値ではなく、あなたのユースケースに合う具体的な指数に注目してください。コーディング中心の製品はコーディング指数を、リサーチアシスタントは推論指数を重視すべきです。benchmark はモデルが更新されると古くなるため、自分の評価セットで確認する出発点の仮説として扱ってください。

Gemini 2.5 Flash Lite
7.4
AA Coding
比較対象モデルの 1% を上回る
126 中 125 位
6.7
AA Intelligence
比較対象モデルの 3% を上回る
128 中 122 位
35.3
AA Math
比較対象モデルの 12% を上回る
81 中 71 位
Gemini 3.5 Flash
70.1
AA Coding
比較対象モデルの 86% を上回る
126 中 18 位
52.0
AA Intelligence
比較対象モデルの 81% を上回る
128 中 24 位
51.0
AA Math
比較対象モデルの 27% を上回る
81 中 59 位

どちらを選ぶべきか

コストが決定的な制約なら、実際の入力対出力の比率で安いモデルから始め、品質が届かない場合にのみ上位へ移してください。応答性が優先なら——ユーザー向けチャット、agent、誰かが待っているあらゆる場面——わずかな価格差よりも p50 latency と throughput を重視してください。最も負荷の高い推論、コーディング、長 context の作業に取り組むなら、benchmark と context window の勝者を主役にし、割に合う場面では高いレートを受け入れてください。両モデルは同じ API の背後にあるため、低リスクな手は、実トラフィックの一部を両者に振り分け、自分のプロンプトでコスト・latency・回答品質を比較してから決めることです。よくあるパターンは階層化(tier)です。簡単で大量のリクエストの大半を安いか速いモデルに送り、より強力なモデルは本当に必要なリクエストのために取っておくことで、コストのごく一部で品質の恩恵の大半を得られます。どれを選んでも、切り替えは可逆に保ってください——モデル名を 1 行変えるだけで、数値や要件が変わった瞬間にトラフィックを元に戻せます。

おすすめ用途

  • コスト重視・大量処理Gemini 2.5 Flash Lite
  • 低遅延のチャットとエージェントGemini 2.5 Flash Lite
  • 高難度の推論とコーディングGemini 3.5 Flash

Gemini 2.5 Flash Lite vs Gemini 3.5 Flash よくある質問

Gemini 2.5 Flash Lite と Gemini 3.5 Flash ではどちらが安いですか?
入力 tokens では Gemini 2.5 Flash Lite の方が安く、100万あたり $0.10、一方は100万あたり $1.50 です。
出力 token では Gemini 2.5 Flash Lite と Gemini 3.5 Flash のどちらが安いですか?
Gemini 2.5 Flash Lite の方が出力料金が安く、100 万あたり $0.40 に対し、もう一方は 100 万あたり $9.00 です。生成が多いワークロードでは通常、出力料金が入力よりも重要なので、それに応じて比較検討してください。
Gemini 2.5 Flash Lite と Gemini 3.5 Flash ではどちらが速いですか?
OrcaRouter のライブ測定では、Gemini 2.5 Flash Lite の方が中央値(p50)応答レイテンシが低いです。
Gemini 2.5 Flash Lite と Gemini 3.5 Flash のどちらがストリーミングが速いですか?
Gemini 3.5 Flash の方が測定 throughput(1 秒あたりの token 数)が高いため、生成が始まれば長い応答がより早く完了します。
benchmark では Gemini 2.5 Flash Lite と Gemini 3.5 Flash のどちらのスコアが高いですか?
Gemini 3.5 Flash が上に示した総合品質指数で先行していますが、benchmark の先行が特定領域に必ず引き継がれるわけではありません——標準化する前に自分のプロンプトで検証してください。
Gemini 2.5 Flash Lite と Gemini 3.5 Flash のどちらを使うべきですか?
コスト、コンテキストウィンドウ、レイテンシ、benchmark 品質という優先度に応じて Gemini 2.5 Flash Lite と Gemini 3.5 Flash を選んでください。上の表は各項目でどのモデルが勝つかを示しています。ワークロードで最も重要な項目に勝者を合わせてください。
Gemini 2.5 Flash Lite と Gemini 3.5 Flash は OrcaRouter でどのように課金されますか?
いずれも上流プロバイダーのレートで token 加算ゼロで課金されます——プロバイダーに直接支払うのと同じ token 単価を、1 つの OrcaRouter API キーとエンドポイント経由で支払います。
Gemini 2.5 Flash Lite と Gemini 3.5 Flash を同じコードで呼び出せますか?
はい。いずれも OrcaRouter の OpenAI-compatible API で公開されているため、モデル名を変えるだけで両者を切り替えられます——SDK の入れ替えも、別の認証情報も不要です。

詳しく見る