openai/gpt-4.1-mini-2025-04-14

openai/gpt-4.1-mini-2025-04-14
VisãoFerramentasJSON
por openai

OpenAI GPT-4.1 Mini: raciocínio com eficiência de custos com contexto de 1M, entrada de imagem e pontuação forte no MATH-500

ctx1.05M tokens
Saída máx.32.8K
Entradaimage + text + file
Saídatext
p50 TTFT2.00 s
ENTRADA$0.40/ 1M tokens
SAÍDA$1.60/ 1M tokens
p50 TTFT2.00 s7 d
p95 TTFT3.57 s7 d
TRÁFEGO7.4Ktokens / 7 d

Este modelo é uma versão reduzida da família GPT-4.1 da OpenAI, lançada especificamente em 14 de abril de 2025. Ele foi projetado para oferecer forte desempenho em raciocínio e seguimento de…

O que é openai/gpt-4.1-mini-2025-04-14?

Quem deve usar este modelo?

Quais modalidades de entrada ele suporta?

O que é a janela de contexto e o comprimento máximo de saída?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4.1-mini-2025-04-14",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Preços

Entrada / 1M tokens$0.400
Saída / 1M tokens$1.60
Leitura de cache / 1M$0.100
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $7.60 · Com cache de prompt $6.55

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000806

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
2.00 s
Velocidade de saída
25.9 tok/s
p95 TTFT
3.57 s
Taxa de erro
0%

Benchmarks públicos

20.2
AA Coding
Melhor que 18% dos modelos comparados
nº 100 de 123
14.8
AA Intelligence
Melhor que 16% dos modelos comparados
nº 104 de 125
46.3
AA Math
Melhor que 22% dos modelos comparados
nº 62 de 81
AIME
43.0
AIME 2025
46.3
GPQA Diamond
66.4
Humanity's Last Exam
4.6
IFBench
38.3
LiveCodeBench
48.3
Long-Context Recall
42.3
MATH-500
92.5
MMLU-Pro
78.1
SciCode
40.4
tau_banking
5.2
TerminalBench Hard
7.6
terminalbench_v2_1
10.1
τ²-Bench
52.9
Fonte: artificialanalysis.ai

Comparativo

openai/gpt-4.1-mini-2025-04-14GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.40$21.00$60.00$5.00
Saída $/M$1.60$168.00$270.00$30.00
Contexto1.0M400K1.1M
Qualidade4/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo por token para openai/gpt-4.1-mini-2025-04-14 no OrcaRouter?
OrcaRouter fatura à taxa do provedor com markup zero: $0.40 por 1 milhão de tokens de entrada e $1.60 por 1 milhão de tokens de saída.
Qual é o tamanho da janela de contexto?
A janela de contexto é de 1,047,576 tokens (aproximadamente 1 milhão de tokens). A saída máxima é de 32,768 tokens por solicitação.
Quais são seus principais pontos fortes?
Oferece uma forte combinação de baixo custo, grande janela de contexto, entrada multimodal (texto, imagem, arquivo) e desempenho sólido de raciocínio, conforme demonstrado pela pontuação de 92.5 no MATH-500.
Como ele se compara ao GPT-4o?
GPT-4o é um modelo carro-chefe mais capaz com suporte de áudio, mas o GPT-4.1 mini é frequentemente mais barato e mais rápido. Nenhuma comparação direta de benchmarks é fornecida, mas o mini é projetado para uso eficiente em produção.
O OrcaRouter lida com a privacidade de dados para este modelo?
OrcaRouter roteia requisições para a infraestrutura da OpenAI. O tratamento de dados segue as políticas da OpenAI e os próprios termos do OrcaRouter. Você deve revisar os acordos de privacidade e uso de dados de ambos os provedores.
Como faço para chamar este modelo usando o cliente Python da OpenAI?
Defina openai.api_base como 'https://api.orcarouter.ai/v1', defina sua chave de API OrcaRouter e use openai.ChatCompletion.create(model='openai/gpt-4.1-mini-2025-04-14', messages=[...]).
Posso usar este modelo para compreensão de imagens?
Sim, ele suporta entradas de imagem (via URLs ou base64) para tarefas como legendagem, resposta a perguntas visuais e OCR. Arquivos também podem ser enviados como imagens ou texto.
Quais são as limitações honestas deste modelo?
Ele pode não corresponder ao GPT-4.1 completo em raciocínio muito complexo, e seu conhecimento é limitado ao corte de treinamento (abril de 2025). Não é adequado para aplicações críticas de segurança sem supervisão humana.
Existe algum desconto à vista?
Não são mencionados descontos específicos de cache para este modelo no OrcaRouter. A cobrança é por token nas taxas indicadas.

Incorporar este selo

openai/gpt-4.1-mini-2025-04-14$0.40/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg" alt="openai/gpt-4.1-mini-2025-04-14 no OrcaRouter" /> </a>
Markdown [![openai/gpt-4.1-mini-2025-04-14](https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg)](https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-4.1-mini-2025-04-14Abrir
Legível por máquina:/llms.txt/llms-full.txt