GPT-4o-mini (2024-07-18)

openai/gpt-4o-mini-2024-07-18
VisionOutilsJSON
par OpenAI · 2024-07-18

GPT-4o mini est le nouveau modèle d'OpenAI après [GPT-4 Omni](/models/openai/gpt-4o), prenant en charge les entrées de texte et d'image avec des sorties de texte. En tant que son petit modèle le plus avancé, il est plusieurs fois plus abordable...

Points de terminaison:/v1/chat/completions/v1/responses
ctx128K tokens
Sortie max16.4K
Entréetext + image + file
Sortietext
p50 TTFT2.26 s
ENTRÉE$0.15/ 1M tokens
SORTIE$0.60/ 1M tokens
p50 TTFT2.26 s7 j
TTFT p952.26 s7 j
TRAFIC44.5Ktokens / 7 j

GPT-4o-mini (2024-07-18) est un modèle multimodal léger développé par OpenAI, conçu pour un traitement économique du texte et des images. Il est destiné aux développeurs et aux organisations ayant…

Qu'est-ce que GPT-4o-mini et à qui est-il destiné ?

Quelles modalités d'entrée GPT-4o-mini prend-il en charge ?

Comment fonctionne l'intégration API avec OrcaRouter ?

Quelles sont les spécifications clés de coût et de contexte ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-2024-07-18",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Tarifs

Entrée / 1M tokens$0.150
Sortie / 1M tokens$0.600
Lecture cache / 1M$0.075
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $2.85 · Avec cache de prompt $2.59

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000303

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
2.26 s
Vitesse de sortie
87.6 tok/s
TTFT p95
2.26 s
Taux d'erreur
0%

Benchmarks publics

11.4
AA Coding
Meilleur que 7 % des modèles comparés
n°114 sur 123
6.9
AA Intelligence
Meilleur que 3 % des modèles comparés
n°119 sur 125
14.7
AA Math
Meilleur que 2 % des modèles comparés
n°78 sur 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Source: artificialanalysis.ai

Comparatif

GPT-4o-mini (2024-07-18)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$0.15$21.00$60.00$5.00
Sortie $/M$0.60$168.00$270.00$30.00
Contexte128K400K1.1M
Qualité2/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par token de GPT-4o-mini sur OrcaRouter ?
GPT-4o-mini coûte 0,15 $ par million de tokens d'entrée et 0,60 $ par million de tokens de sortie. OrcaRouter facture au tarif exact du fournisseur OpenAI, sans majoration.
Quelle est la taille de la fenêtre de contexte pour GPT-4o-mini ?
La fenêtre de contexte est de 128 000 jetons, ce qui permet des entrées très longues comme des documents complets ou des conversations prolongées.
Quels sont les principaux atouts de GPT-4o-mini ?
Il offre un équilibre entre faible coût, entrée multimodale (texte, images, fichiers), une grande fenêtre de contexte et un raisonnement mathématique solide (78,9 sur MATH-500). Il est plus rapide et moins cher que les modèles GPT-4 de taille complète.
Comment GPT-4o-mini se compare-t-il à GPT-4o ?
GPT-4o-mini est moins cher (0,15 $ / 0,60 $ par million de jetons contre 2,50 $ / 10,00 $) mais a des scores de benchmark inférieurs (par exemple, MATH-500 78,9 contre ~90). Les deux prennent en charge les entrées multimodales et un contexte de 128k.
OrcaRouter traite-t-il la confidentialité des données différemment d'un accès direct à OpenAI ?
OrcaRouter transmet les requêtes directement à l'API d'OpenAI sans stocker ni journaliser vos données au-delà de la surveillance standard de l'utilisation. Pour plus de détails sur le traitement des données, consultez la politique de confidentialité d'OrcaRouter et les conditions d'utilisation des données d'OpenAI.
Comment appeler GPT-4o-mini via une API compatible OpenAI ?
Définissez l'URL de base sur https://api.orcarouter.ai/v1 et utilisez l'ID de modèle "openai/gpt-4o-mini-2024-07-18". L'API est entièrement compatible avec le format de complétion de chat OpenAI, y compris le streaming.
Puis-je passer des images et des fichiers en même temps que du texte dans une seule requête API ?
Oui. Utilisez le format de contenu en plusieurs parties : incluez un tableau de contenu avec le type "text" et le type "image_url" (pour les images) ou le type "file" (pour les fichiers). Chaque partie est convertie en jetons.
Y a-t-il un montant de dépense minimale ou un engagement mensuel requis sur OrcaRouter ?
Non. OrcaRouter facture par jeton, sans minimums. Vous ne payez que pour ce que vous utilisez, aux tarifs du fournisseur, sans aucune majoration.

Intégrer ce badge

OpenAI: GPT-4o-mini (2024-07-18)$0.15/M in2257ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-2024-07-18" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-2024-07-18.svg" alt="OpenAI: GPT-4o-mini (2024-07-18) sur OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini (2024-07-18)](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-2024-07-18.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-2024-07-18)

Fiche du modèle en données

GET /api/public/models/openai/gpt-4o-mini-2024-07-18Ouvrir
Lisible par machine:/llms.txt/llms-full.txt