Gemini 3.5 Flash-Lite

google/gemini-3.5-flash-lite
新着注目
ビジョン音声ツールJSON推論
提供 Google · 2026-07-21

Gemini 3.5 Flash-Lite は、Google の最もコスト効率の高い Gemini モデルであり、コールあたりのコストが支配的な非常に高ボリューム、レイテンシーに敏感なワークロード向けに特別に構築されています。その価格帯にもかかわらず、ネイティブでマルチモーダル(テキスト、画像、ビデオ、音声、およびテキスト出力付きファイルを受け入れ)であり、より大きな Flash ティアと同じ 1M トークンのコンテキストウィンドウと最大 64K の出力トークンを備えているため、長いドキュメントやマルチメディア入力も対応可能です。3.6 Flash の価格の約 5 分の 1 で、分類、抽出、ルーティング、要約、軽量エージェント、合成データ生成、および数百万回実行されるあらゆるパイプラインに適したツールです。設定可能な推論努力、ネイティブツール呼び出し、構造化出力を引き続きサポートし、軽量モデルとしてはエージェントおよび長コンテキストベンチマークで力を発揮します。例えば、OSWorld-Verified で 74.0%、128k マルチニードル検索で 72.2% であり、以前の 3.1 Flash-Lite を大きく上回っています。OpenAI のチャット補完形式と Gemini のネイティブ generateContent API の両方に対応しているため、単一の統合の背後でより重いモデルと混在させることができます。簡単で高ボリュームのトラフィックを Flash-Lite にルーティングし、難しいタスクを 3.6 Flash または Pro モデルにエスカレーションします。

コンテキスト1.05M トークン
最大出力65.5K
入力text + image + video + file + audio
出力text
p50 TTFT1.30 s
入力$0.30/ 100万 tokens
出力$2.50/ 100万 tokens
p50 TTFT1.30 s7日
p95 TTFT10.00 s7日
トラフィック5.9Mtokens / 7日

Google Gemini 3.5 Flash-Liteは、Googleが開発したマルチモーダル言語モデルで、OrcaRouterのOpenAI互換APIを通じて提供されます。テキスト、画像、動画、ファイル、音声の入力を処理でき、複数のデータタイプを組み合わせたタスクに適しています。このモデルは1,048,576トークンのコンテキストウィンドウを持ち、最大65,536トークンの出力をサポートします…

Google Gemini 3.5 Flash-Liteとは何ですか?

このモデルは誰に向けて設計されていますか?

モデルはどのモダリティをサポートしていますか?

コンテキストウィンドウと最大出力の大きさは?

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="google/gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

料金

入力 / 1M tokens$0.300
出力 / 1M tokens$2.50
キャッシュ読み取り / 1M$0.030
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $9.60 · プロンプトキャッシュ利用時 $8.66

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.001252

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
1.30 s
出力速度
829 tok/s
p95 TTFT
10.00 s
エラー率
5.0%

公開ベンチマーク

49.3
AA Coding
比較対象モデルの 60% を上回る
122 中 49 位
36.5
AA Intelligence
比較対象モデルの 54% を上回る
124 中 57 位
CharXiv Reasoning (no tools)
74.5
CharXiv Reasoning (with tools)
76.5
GDM-MRCR v2 8-needle (128k avg)
72.2
GDM-MRCR v2 8-needle (1M pointwise)
21.3
GPQA Diamond
83.8
Humanity's Last Exam
17.5
Long-Context Recall
62.0
MLE-Bench
39.2
OSWorld-Verified
74.0
SciCode
40.9
SWE-Bench Pro (Public)
54.2
tau_banking
16.5
Terminal-bench 2.1 (Terminus-2)
54.0
terminalbench_v2_1
53.6
ソース: artificialanalysis.ai, deepmind.google

比較

Gemini 3.5 Flash-LiteGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
入力 $/100万$0.30$2.00$4.00$0.50
出力 $/100万$2.50$12.00$18.00$3.00
コンテキスト1.0M1.0M1.0M1.0M
品質6/1010/1010/109/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

OrcaRouter上のGemini 3.5 Flash-Liteのトークンあたりの価格はいくらですか?
価格は入力トークン100万個あたり0.30ドル、出力トークン100万個あたり2.50ドルです。これらはプロバイダー料金であり、マークアップはありません。入力トークンにはすべてのモダリティ(テキスト、画像、動画、音声、ファイル)が含まれます。出力トークンは生成されたテキストです。
コンテキストウィンドウサイズとは何ですか?
コンテキストウィンドウは1,048,576トークン(約100万トークン)です。最大出力長は65,536トークンです。これにより、非常に長いドキュメント、動画、または音声録音を1回のAPIリクエストで処理できます。
このモデルの主な強みは何ですか?
主な強みは、トークンあたりのコストが非常に低いこと、5つの入力モダリティ(テキスト、画像、動画、音声、ファイル)をサポートすること、巨大な100万トークンのコンテキストウィンドウ、そしてツール使用機能(ツール使用時のCharXiv推論スコアは76.5)です。高スループットでコストに敏感な本番パイプライン向けに設計されています。
Gemini 3.5 Proのようなより大きなモデルと比べてどうですか?
直接のベンチマーク比較は提供されていません。このモデルはflash‑liteの一種として、生のパフォーマンスよりも効率性と低コストを優先しています。Gemini 3.5 Proのような大規模モデルは複雑な推論タスクでより高い精度を達成する可能性がありますが、トークンあたりのコストが大幅に高くなります。コストとスループットが重要な場合は、このモデルを使用してください。
モデルはプロンプトをキャッシュしてコストを削減しますか?
提供された情報には、キャッシングメカニズムや割引キャッシュトークン価格については記載されていません。すべてのトークンは標準の入力レートで課金されると想定してください。キャッシングが重要な場合は、OrcaRouterまたはGoogleに利用可能な割引がないか確認してください。
このモデルにOpenAI互換のAPIを介してアクセスするにはどうすればよいですか?
OrcaRouterのAPIをベースURL https://api.orcarouter.ai/v1 で使用してください。モデルパラメーターを"google/gemini-3.5-flash-lite"に設定してください。このAPIは、マルチモーダルコンテンツやツール定義を含むOpenAIチャット完了フォーマットと完全に互換性があります。
どのようなデータ取扱いとプライバシーが期待できますか?
データの取り扱いは、Google(プロバイダー)のポリシーおよびOrcaRouterの利用規約に従います。モデルはあなたの入力を処理し、出力はあなたに返されます。このモデルに関する特定のプライバシー認証は提供されていません。機密データについては、プロバイダーのデータ処理契約を確認してください。
このモデルをリアルタイムアプリケーションに使用できますか?
レイテンシの詳細は指定されていません。モデルは短い入力に対しては数秒で応答を返すことができますが、非常に長いプロンプト(約100万トークン)の処理には数十秒かかる場合があります。中程度の入力サイズのニアリアルタイムアプリケーションに適しています。厳格なリアルタイム要件の場合は、実際に使用する入力長でテストしてください。
CharXiv Reasoning benchmarkのスコアは何ですか?
モデルは、CharXiv Reasoning with toolsにおいて76.5のスコアを達成しました。このベンチマークはグラフの理解と推論をテストします。スコアは中程度の性能を示しており、モデルはグラフを解釈し質問に答えることができますが、専用の推論モデルほどのレベルではありません。他のベンチマークスコアは提供されていません。
OrcaRouterを利用するのに最低料金や最低契約期間はありますか?
OrcaRouterは最小月額支出を課しません。使用したトークンのみに対して、ゼロマークアップのプロバイダー料金で請求されます。前払い料金や長期契約は不要です。APIキーにサインアップしてリクエストを開始するだけです。

このバッジを埋め込む

Google: Gemini 3.5 Flash-Lite$0.30/M in1298ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg" alt="OrcaRouter の Google: Gemini 3.5 Flash-Lite" /> </a>
Markdown [![Google: Gemini 3.5 Flash-Lite](https://www.orcarouter.ai/embed/google/gemini-3.5-flash-lite.svg)](https://www.orcarouter.ai/models/google/gemini-3.5-flash-lite)

モデルカードをデータで取得

GET /api/public/models/google/gemini-3.5-flash-lite開く