GPT-4o-mini

openai/gpt-4o-mini
VisionOutilsJSON
par OpenAI · 2024-07-18

GPT-4o mini est le nouveau modèle d'OpenAI après [GPT-4 Omni](/models/openai/gpt-4o), prenant en charge les entrées de texte et d'image avec des sorties de texte. En tant que son petit modèle le plus avancé, il est plusieurs fois plus abordable...

Points de terminaison:/v1/chat/completions/v1/responses
ctx128K tokens
Sortie max16.4K
Entréetext + image + file
Sortietext
p50 TTFT4.23 s
ENTRÉE$0.15/ 1M tokens
SORTIE$0.60/ 1M tokens
p50 TTFT4.23 s7 j
TTFT p9510.00 s7 j
TRAFIC9.6Mtokens / 7 j

GPT-4o-mini est une variante plus petite et plus rapide du modèle GPT-4o d'OpenAI, optimisée pour un coût de calcul réduit tout en conservant des capacités multimodales. Elle peut traiter du texte,…

Qu'est-ce que GPT-4o-mini ?

Qui devrait utiliser GPT-4o-mini ?

En quoi l'architecture du modèle diffère-t-elle de GPT-4o ?

Quelles modalités de saisie sont prises en charge ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Tarifs

Entrée / 1M tokens$0.150
Sortie / 1M tokens$0.600
Lecture cache / 1M$0.075
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $2.85 · Avec cache de prompt $2.59

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000303

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
4.23 s
Vitesse de sortie
870 tok/s
TTFT p95
10.00 s
Taux d'erreur
0.30%

Benchmarks publics

11.4
AA Coding
Meilleur que 7 % des modèles comparés
n°114 sur 123
6.9
AA Intelligence
Meilleur que 3 % des modèles comparés
n°119 sur 125
14.7
AA Math
Meilleur que 2 % des modèles comparés
n°78 sur 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Source: artificialanalysis.ai

Comparatif

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$0.15$21.00$60.00$5.00
Sortie $/M$0.60$168.00$270.00$30.00
Contexte128K400K1.1M
Qualité2/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût pour utiliser GPT-4o-mini via OrcaRouter ?
Les jetons d’entrée coûtent 0,15 $ par 1M, les jetons de sortie coûtent 0,60 $ par 1M, correspondant exactement aux tarifs d’OpenAI sans marge.
Quelle est la fenêtre de contexte de GPT-4o-mini?
La fenêtre de contexte est de 128 000 tokens, et la sortie maximale est de 16 384 tokens.
Quels sont les principaux atouts de GPT-4o-mini ?
Il combine une entrée multimodale (texte, images, fichiers), une grande fenêtre de contexte, une inférence rapide et un faible coût pour un large éventail de tâches.
Comment GPT-4o-mini se compare-t-il à GPT-4o ?
GPT-4o-mini est environ 94% moins cher en matière de tarification par token, mais peut être moins précis pour le raisonnement complexe et la génération créative. Sur MATH-500, il obtient un score de 78,9 contre le score plus élevé de GPT-4o.
Est-ce qu'OrcaRouter journalise ou stocke mes prompts ?
OrcaRouter ne journalise ni ne stocke vos prompts ; toutes les données sont transmises à OpenAI. Référez-vous à la politique d'utilisation des données d'OpenAI pour leur traitement.
Comment appeler GPT-4o-mini via l'API d'OrcaRouter ?
Utilisez le point de terminaison compatible OpenAI à l'adresse https://api.orcarouter.ai/v1 avec l'identifiant de modèle "openai/gpt-4o-mini". Incluez votre clé API OrcaRouter.
Est-ce que GPT-4o-mini peut traiter à la fois du texte et des images dans la même requête ?
Oui, il accepte du texte, des images et des fichiers simultanément dans le contexte de 128K tokens.
Quelle est la vitesse/latence de GPT-4o-mini ?
La latence est généralement faible—le premier token est typiquement inférieur à une seconde pour des requêtes modérées—mais varie selon la longueur du contexte et la charge de l'API. Le streaming réduit la latence perçue.

Intégrer ce badge

OpenAI: GPT-4o-mini$0.15/M in4232ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini sur OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Fiche du modèle en données

GET /api/public/models/openai/gpt-4o-miniOuvrir
Lisible par machine:/llms.txt/llms-full.txt