openai/gpt-4.1-mini-2025-04-14

openai/gpt-4.1-mini-2025-04-14
VisionOutilsJSON
par openai

OpenAI GPT-4.1 Mini : raisonnement économique avec contexte de 1M, entrée d'image et score élevé à MATH-500

Points de terminaison:/v1/chat/completions/v1/responses
ctx1.05M tokens
Sortie max32.8K
Entréeimage + text + file
Sortietext
p50 TTFT2.00 s
ENTRÉE$0.40/ 1M tokens
SORTIE$1.60/ 1M tokens
p50 TTFT2.00 s7 j
TTFT p953.57 s7 j
TRAFIC7.4Ktokens / 7 j

Ce modèle est une version réduite de la famille GPT-4.1 d'OpenAI, spécifiquement publiée le 14 avril 2025. Il est conçu pour offrir de solides performances en raisonnement et en suivi d'instructions…

Qu'est-ce que openai/gpt-4.1-mini-2025-04-14 ?

Qui devrait utiliser ce modèle ?

Quelles modalités d'entrée prend-il en charge ?

Quelle est la fenêtre de contexte et la longueur maximale de sortie ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4.1-mini-2025-04-14",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Tarifs

Entrée / 1M tokens$0.400
Sortie / 1M tokens$1.60
Lecture cache / 1M$0.100
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $7.60 · Avec cache de prompt $6.55

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000807

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
2.00 s
Vitesse de sortie
25.9 tok/s
TTFT p95
3.57 s
Taux d'erreur
0%

Benchmarks publics

20.2
AA Coding
Meilleur que 18 % des modèles comparés
n°100 sur 123
14.8
AA Intelligence
Meilleur que 16 % des modèles comparés
n°104 sur 125
46.3
AA Math
Meilleur que 22 % des modèles comparés
n°62 sur 81
AIME
43.0
AIME 2025
46.3
GPQA Diamond
66.4
Humanity's Last Exam
4.6
IFBench
38.3
LiveCodeBench
48.3
Long-Context Recall
42.3
MATH-500
92.5
MMLU-Pro
78.1
SciCode
40.4
tau_banking
5.2
TerminalBench Hard
7.6
terminalbench_v2_1
10.1
τ²-Bench
52.9
Source: artificialanalysis.ai

Comparatif

openai/gpt-4.1-mini-2025-04-14GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$0.40$21.00$60.00$5.00
Sortie $/M$1.60$168.00$270.00$30.00
Contexte1.0M400K1.1M
Qualité4/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par jeton pour openai/gpt-4.1-mini-2025-04-14 sur OrcaRouter ?
OrcaRouter facture au tarif du fournisseur sans aucune majoration : $0.40 par million de tokens d'entrée et $1.60 par million de tokens de sortie.
Quelle est la taille de la fenêtre de contexte ?
La fenêtre de contexte est de 1,047,576 tokens (environ 1 million de tokens). La sortie maximale est de 32,768 tokens par requête.
Quels sont ses principaux atouts ?
Il offre une combinaison solide de faible coût, de grande fenêtre de contexte, d'entrée multimodale (texte, image, fichier) et de performances de raisonnement solides, comme le montre le score MATH-500 de 92.5.
Comment se compare-t-il à GPT-4o?
GPT-4o est un modèle phare plus performant avec prise en charge audio, mais GPT-4.1 mini est souvent moins cher et plus rapide. Aucune comparaison directe de benchmarks n'est fournie, mais le mini est conçu pour une utilisation efficace en production.
Est-ce qu'OrcaRouter gère la confidentialité des données pour ce modèle ?
OrcaRouter achemine les requêtes vers l’infrastructure d’OpenAI. Le traitement des données suit les politiques d’OpenAI et les conditions propres d’OrcaRouter. Vous devriez examiner les accords de confidentialité et d’utilisation des données des deux fournisseurs.
Comment puis-je appeler ce modèle en utilisant le client Python OpenAI ?
Définissez openai.api_base sur 'https://api.orcarouter.ai/v1', définissez votre clé API OrcaRouter, et utilisez openai.ChatCompletion.create(model='openai/gpt-4.1-mini-2025-04-14', messages=[...]).
Puis-je utiliser ce modèle pour la compréhension d'images ?
Oui, il prend en charge les entrées d'image (via des URL ou base64) pour des tâches comme le sous-titrage d'images, la réponse à des questions visuelles et l'OCR. Les fichiers peuvent également être téléchargés en tant qu'images ou texte.
Quelles sont les limites honnêtes de ce modèle ?
Il peut ne pas correspondre au GPT-4.1 complet sur un raisonnement très complexe, et ses connaissances sont limitées à la date de coupure de l'entraînement (avril 2025). Il n'est pas adapté aux applications critiques pour la sécurité sans supervision humaine.
Y a-t-il une réduction pour la mise en cache ?
Aucune remise spécifique de mise en cache n'est mentionnée pour ce modèle sur OrcaRouter. La facturation est par jeton aux tarifs indiqués.

Intégrer ce badge

openai/gpt-4.1-mini-2025-04-14$0.40/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg" alt="openai/gpt-4.1-mini-2025-04-14 sur OrcaRouter" /> </a>
Markdown [![openai/gpt-4.1-mini-2025-04-14](https://www.orcarouter.ai/embed/openai/gpt-4.1-mini-2025-04-14.svg)](https://www.orcarouter.ai/models/openai/gpt-4.1-mini-2025-04-14)

Fiche du modèle en données

GET /api/public/models/openai/gpt-4.1-mini-2025-04-14Ouvrir
Lisible par machine:/llms.txt/llms-full.txt