GPT-4o-mini

openai/gpt-4o-mini
VisãoFerramentasJSON
por OpenAI · 2024-07-18

GPT-4o mini é o modelo mais novo da OpenAI depois do [GPT-4 Omni](/models/openai/gpt-4o), suportando entradas de texto e imagem com saídas de texto. Como seu modelo pequeno mais avançado, é muitas vezes mais acessível…

ctx128K tokens
Saída máx.16.4K
Entradatext + image + file
Saídatext
p50 TTFT4.23 s
ENTRADA$0.15/ 1M tokens
SAÍDA$0.60/ 1M tokens
p50 TTFT4.23 s7 d
p95 TTFT10.00 s7 d
TRÁFEGO9.6Mtokens / 7 d

GPT-4o-mini é uma variante menor e mais rápida do modelo GPT-4o da OpenAI, otimizada para menor custo computacional, mantendo capacidades multimodais. Ela pode processar texto, imagens e arquivos…

O que é GPT-4o-mini?

Quem deve usar o GPT-4o-mini?

Como a arquitetura do modelo difere da do GPT-4o?

Quais modalidades de entrada são suportadas?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Preços

Entrada / 1M tokens$0.150
Saída / 1M tokens$0.600
Leitura de cache / 1M$0.075
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $2.85 · Com cache de prompt $2.59

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000302

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
4.23 s
Velocidade de saída
870 tok/s
p95 TTFT
10.00 s
Taxa de erro
0.30%

Benchmarks públicos

11.4
AA Coding
Melhor que 7% dos modelos comparados
nº 114 de 123
6.9
AA Intelligence
Melhor que 3% dos modelos comparados
nº 119 de 125
14.7
AA Math
Melhor que 2% dos modelos comparados
nº 78 de 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Fonte: artificialanalysis.ai

Comparativo

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.15$21.00$60.00$5.00
Saída $/M$0.60$168.00$270.00$30.00
Contexto128K400K1.1M
Qualidade2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo para usar o GPT-4o-mini através do OrcaRouter?
Os tokens de entrada custam $0,15 por 1M, os tokens de saída custam $0,60 por 1M, correspondendo exatamente às taxas da OpenAI com margem zero.
Qual é a janela de contexto do GPT-4o-mini?
A janela de contexto é 128,000 tokens, e a saída máxima é 16,384 tokens.
Quais são os principais pontos fortes do GPT-4o-mini?
Ele combina entrada multimodal (texto, imagens, arquivos), uma grande janela de contexto, inferência rápida e baixo custo para uma ampla gama de tarefas.
Como o GPT-4o-mini se compara ao GPT-4o?
GPT-4o-mini é aproximadamente 94% mais barato na precificação por token, mas pode ser menos preciso em raciocínio complexo e geração criativa. No MATH-500, ele obtém 78,9 contra a pontuação mais alta do GPT-4o.
O OrcaRouter registra ou armazena meus prompts?
OrcaRouter não registra ou armazena seus prompts; todos os dados passam para a OpenAI. Consulte a política de uso de dados da OpenAI para o tratamento deles.
Como faço para chamar o GPT-4o-mini através da API do OrcaRouter?
Use o endpoint compatível com OpenAI em https://api.orcarouter.ai/v1 com o model id "openai/gpt-4o-mini". Inclua sua chave de API OrcaRouter.
O GPT-4o-mini consegue processar tanto texto quanto imagens na mesma requisição?
Sim, aceita texto, imagens e arquivos simultaneamente dentro do contexto de 128K tokens.
Qual é a velocidade/latência do GPT-4o-mini?
A latência é geralmente baixa—o primeiro token normalmente leva menos de um segundo para prompts moderados—mas varia com o comprimento do contexto e a carga da API. O streaming reduz a latência percebida.

Incorporar este selo

OpenAI: GPT-4o-mini$0.15/M in4232ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini no OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-4o-miniAbrir
Legível por máquina:/llms.txt/llms-full.txt