GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
VisionOutilsJSON
par OpenAI · 2024-08-06

La version du 2024-08-06 de GPT-4o offre des performances améliorées dans les sorties structurées, avec la capacité de fournir un schéma JSON dans le respone_format. En savoir plus [ici](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" pour "omni") est...

Points de terminaison:/v1/chat/completions/v1/responses
ctx128K tokens
Sortie max16.4K
Entréetext + image + file
Sortietext
p50 TTFT2.00 s
ENTRÉE$2.50/ 1M tokens
SORTIE$10.00/ 1M tokens
p50 TTFT2.00 s7 j
TTFT p957.61 s7 j
TRAFIC207.0Ktokens / 7 j

GPT-4o (2024-08-06) est une version du modèle GPT-4o d'OpenAI, publiée en août 2024. Il s'agit d'un grand modèle de langage multimodal capable de traiter des entrées textuelles, d'images et de…

Qu'est-ce que GPT-4o (2024-08-06) ?

Pour qui est ce modèle ?

Quelles modalités d'entrée prend-il en charge ?

Spécifications clés en un coup d'œil

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Tarifs

Entrée / 1M tokens$2.50
Sortie / 1M tokens$10.00
Lecture cache / 1M$1.25
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $47.50 · Avec cache de prompt $43.13

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.005043

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
2.00 s
Vitesse de sortie
477 tok/s
TTFT p95
7.61 s
Taux d'erreur
0%

Benchmarks publics

16.6
AA Coding
Meilleur que 12 % des modèles comparés
n°108 sur 123
9.6
AA Intelligence
Meilleur que 10 % des modèles comparés
n°110 sur 125
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.9
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
35.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
Source: artificialanalysis.ai

Comparatif

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$2.50$21.00$60.00$5.00
Sortie $/M$10.00$168.00$270.00$30.00
Contexte128K400K1.1M
Qualité3/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par token pour GPT-4o (2024-08-06) sur OrcaRouter ?
Le prix est de 2,50 $ par million de jetons d'entrée et de 10,00 $ par million de jetons de sortie, facturés au tarif du fournisseur OpenAI sans aucune majoration de la part d'OrcaRouter. Les entrées d'images et de fichiers entraînent des coûts de jetons supplémentaires conformément à la politique d'OpenAI.
Quelle est la fenêtre de contexte et le nombre maximal de jetons de sortie ?
La fenêtre de contexte est de 128 000 tokens. La sortie maximale est de 16 384 tokens. Cela permet le traitement de longs documents ou conversations et la génération de réponses substantielles.
Quels sont les principaux atouts de ce modèle ?
Il offre un raisonnement mathématique solide (79.5 sur MATH-500), une entrée multimodale (texte, images, fichiers), une grande fenêtre de contexte, et la génération de haute qualité d'OpenAI. Il est bien adapté pour les tâches de raisonnement complexe et de vision.
Comment ce modèle se compare-t-il à un modèle moins cher comme GPT-4o mini ?
GPT-4o (2024-08-06) est plus cher mais généralement plus performant dans les tâches de raisonnement et multimodales. GPT-4o mini est moins cher (0,15 $ / 0,60 $ pour 1 million de jetons) et suffisant pour les tâches simples. Choisissez en fonction de la complexité de la tâche et du budget.
Quelles politiques de traitement des données s'appliquent ?
Vos données sont envoyées à OpenAI pour traitement. OrcaRouter ne stocke pas les prompts. Les politiques d'utilisation des données d'OpenAI s'appliquent. Utilisez le routage multi-fournisseur d'OrcaRouter pour diriger les requêtes vers des fournisseurs répondant à vos exigences de conformité.
Puis-je utiliser ce modèle avec le client Python OpenAI ?
Oui, en définissant l'URL de base sur https://api.orcarouter.ai/v1 et en utilisant l'ID de modèle "openai/gpt-4o-2024-08-06". Votre code existant pour ChatCompletion, le streaming et l'appel de fonction fonctionne sans modifications.
Comment envoyer des images via l'API ?
Inclure l'image sous forme de chaîne encodée en base64 ou d'URL dans le tableau de contenu d'un message, en utilisant le format "image_url" avec le paramètre de détail. Le modèle interprète les images pour analyse. Cela suit le format de l'API multimodale d'OpenAI.
Quelle est la sortie maximale qui peut être générée par requête ?
La sortie maximale est de 16,384 tokens. Utilisez le paramètre max_tokens pour contrôler la longueur de la réponse. Soyez conscient que des sorties plus longues augmentent le coût et la latence.
Ce modèle est-il disponible en streaming ?
Oui, lors de l'utilisation de l'API compatible avec OpenAI, vous pouvez définir stream=True pour recevoir les réponses de manière incrémentielle. Cela fonctionne avec le endpoint d'OrcaRouter.
Puis-je utiliser ce modèle gratuitement ou avec un essai ?
Le modèle est facturé aux tarifs du fournisseur. OrcaRouter peut offrir un niveau gratuit ou des crédits d'essai—consultez leur site Web pour les offres actuelles. L'utilisation au-delà des crédits gratuits entraîne les coûts standard par jeton.

Intégrer ce badge

OpenAI: GPT-4o (2024-08-06)$2.50/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) sur OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

Fiche du modèle en données

GET /api/public/models/openai/gpt-4o-2024-08-06Ouvrir
Lisible par machine:/llms.txt/llms-full.txt