Gemini 3.8 Flash

google/gemini-3.8-flash
NovoDestaque
VisãoÁudioFerramentasJSONRaciocínio
por Google · 2026-09-02

Gemini 3.8 Flash é o modelo Flash mais inteligente do Google, com ganhos significativos em relação ao 3.7 Flash em engenharia de software, tarefas de agente e raciocínio de múltiplas etapas.

ctx1M tokens
Saída máx.65K
Entradatext + image + video + file + audio
Saídatext
p50 TTFT4.53 s
ENTRADA$0.75/ 1M tokens
SAÍDA$3.75/ 1M tokens
p50 TTFT4.53 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO105.8Mtokens / 7 d

Gemini 3.8 Flash é voltado para equipes que precisam de um modelo do Google com entrada multimodal ampla, janela de contexto longa, grande limite de saída e API compatível com OpenAI. Ele se adequa a…

Quem deve usar o Gemini 3.8 Flash?

Quais entradas e saídas são suportadas?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Gemini SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

Preços

Entrada / 1M tokens$0.750
Saída / 1M tokens$3.75
Leitura de cache / 1M$0.075
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $16.50 · Com cache de prompt $14.14

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.001886

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
4.53 s
Velocidade de saída
282 tok/s
p95 TTFT
10.00 s
Taxa de erro
0.54%

Benchmarks públicos

76.3
AA Coding
Melhor que 95% dos modelos comparados
nº 7 de 137
58.7
AA Intelligence
Melhor que 92% dos modelos comparados
nº 11 de 139
GPQA Diamond
95.3
HLE-Verified
54.9
Humanity's Last Exam
47.8
Long-Context Recall
81.0
SciCode
53.6
tau_banking
44.9
terminalbench_v2_1
87.6
Fonte: artificialanalysis.ai, deepmind.google

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News13 menções · 7 d13 a mais que na semana anterior

Comparativo

Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.1 Pro Preview Custom ToolsGemini 3 Flash Preview
Entrada $/M$0.75$2.00$4.00$0.50
Saída $/M$3.75$12.00$18.00$3.00
Contexto1.0M1.0M1.0M1.0M
Qualidade9/1010/1010/109/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa o Gemini 3.8 Flash através do OrcaRouter?
OrcaRouter cobra o Gemini 3.8 Flash pela taxa do provedor, com zero margem de lucro: $0.75 por 1M de tokens de entrada e $3.75 por 1M de tokens de saída. Nenhuma taxa de sessão ou taxa de plataforma está listada no catálogo. Como a saída custa cinco vezes o preço da entrada, gerações longas custarão proporcionalmente mais do que prompts longos.
Qual é a janela de contexto e o tamanho máximo de saída?
O Gemini 3.8 Flash tem uma janela de contexto de 1.048.576 tokens e uma saída máxima de 65.536 tokens. A janela de contexto é anunciada para entradas de texto, imagem, vídeo, arquivo e áudio. O provedor não fornece uma fórmula separada de tokens por mídia nesta listagem.
Quais são os principais pontos fortes do Gemini 3.8 Flash?
As capacidades listadas são um contexto de 1.048.576 tokens, uma saída máxima de 65.536 tokens, entrada multimodal abrangente e uma pontuação de 54,9 no HLE-Verified. Esses recursos são adequados para trabalhos com perguntas de nível especializado, tarefas com documentos longos e compreensão multimídia por meio de uma API compatível com OpenAI. Nenhuma alegação adicional de qualidade é feita no catálogo.
Como o Gemini 3.8 Flash se compara com outros modelos?
O registro do catálogo não contém pontuações de benchmark ou preços para qualquer modelo alternativo. As comparações devem ser feitas executando conjuntos de testes idênticos por meio do OrcaRouter e medindo precisão, custo e velocidade. Use o ID do modelo google/gemini-3.8-flash juntamente com outros IDs e compare os campos realmente retornados para sua carga de trabalho.
Quais termos de tratamento de dados se aplicam?
Esta página de catálogo não informa regras de retenção, treinamento ou compartilhamento de dados. Se você enviar dados para o Gemini 3.8 Flash por meio do OrcaRouter, o conteúdo da solicitação é processado para concluir a transação. Os termos comerciais para tratamento de dados estão nos termos do provedor Google e nos termos do OrcaRouter. Verifique esses documentos antes de enviar dados regulamentados ou confidenciais.
Como faço para invocar o Gemini 3.8 Flash usando uma API compatível com OpenAI?
Use a URL base do OrcaRouter https://api.orcarouter.ai/v1 e defina o campo model para google/gemini-3.8-flash. Em seguida, envie uma solicitação padrão de conclusão de chat no estilo OpenAI com sua chave de API do OrcaRouter. Clientes existentes que suportam chat.completions.create devem funcionar após alterar a URL base e o nome do modelo.
O OrcaRouter adiciona um markup à taxa do provedor?
Não. A listagem do catálogo diz que o modelo é cobrado pela tarifa do provedor com margem zero. Os preços de tokens de entrada e saída mostrados são de US$ 0,75 por 1M de entrada e US$ 3,75 por 1M de saída. Isso faz com que o custo por token listado seja a tarifa direta do provedor.
O cache de prompt está disponível para este modelo?
Os fatos do modelo não mencionam cache de prompt, preços de cache hit ou comportamento automático de cache. Você não deve depender de prompts em cache para reduzir custos. A estimativa de custo mais segura é baseada na cobrança integral de tokens de entrada a US$ 0,75 por 1 milhão de tokens de entrada.
Quais modalidades de entrada são suportadas?
O modelo aceita entrada de texto, imagem, vídeo, arquivo e áudio. A saída é listada em até 65.536 tokens e nenhuma modalidade de saída de mídia é documentada. Para prompts de imagem, vídeo, arquivo ou áudio, teste o formato de conteúdo do seu cliente porque o esquema de mídia da API não está descrito no catálogo.

Incorporar este selo

Google: Gemini 3.8 Flash$0.75/M in4529ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/google/gemini-3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg" alt="Google: Gemini 3.8 Flash no OrcaRouter" /> </a>
Markdown [![Google: Gemini 3.8 Flash](https://www.orcarouter.ai/embed/google/gemini-3.8-flash.svg)](https://www.orcarouter.ai/models/google/gemini-3.8-flash)

Ficha do modelo como dados

GET /api/public/models/google/gemini-3.8-flashAbrir
Legível por máquina:/llms.txt/llms-full.txt