GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
VisionOutilsJSON
par OpenAI · 2024-08-06

La version du 2024-08-06 de GPT-4o offre des performances améliorées dans les sorties structurées, avec la capacité de fournir un schéma JSON dans le respone_format. En savoir plus [ici](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" pour "omni") est...

Points de terminaison:/v1/chat/completions/v1/responses
ctx128K tokens
Sortie max16K
Entréetext + image + file
Sortietext
p50 TTFT687 ms
ENTRÉE$2.50/ 1M tokens
SORTIE$10.00/ 1M tokens
p50 TTFT687 ms7 j
TTFT p95926 ms7 j
TRAFIC301tokens / 7 j

GPT-4o (2024-08-06) est une version du modèle GPT-4o d'OpenAI, publiée en août 2024. Il s'agit d'un grand modèle de langage multimodal capable de traiter des entrées textuelles, d'images et de…

Qu'est-ce que GPT-4o (2024-08-06) ?

Pour qui est ce modèle ?

Quelles modalités d'entrée prend-il en charge ?

Spécifications clés en un coup d'œil

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Tarifs

Tarifs
Entrée / 1M tokens$2.50
Sortie / 1M tokens$10.00
Lecture cache / 1M$1.25
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $47.50 · Avec cache de prompt $43.13

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.005043

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
687 ms
Vitesse de sortie
31.0 tok/s
TTFT p95
926 ms
Taux d'erreur
9.1%

Benchmarks publics

16.6
AA Coding
Meilleur que 11 % des modèles comparés
n°123 sur 138
7.7
AA Intelligence
Meilleur que 9 % des modèles comparés
n°128 sur 141
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.3
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
41.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
Source: artificialanalysis.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News0 mentions · 7 j

Comparatif

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$2.50$21.00$60.00$5.00
Sortie $/M$10.00$168.00$270.00$30.00
Contexte128K400K1.1M
Qualité3/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par token pour GPT-4o (2024-08-06) sur OrcaRouter ?
Le prix est de 2,50 $ par million de jetons d'entrée et de 10,00 $ par million de jetons de sortie, facturés au tarif du fournisseur OpenAI sans aucune majoration de la part d'OrcaRouter. Les entrées d'images et de fichiers entraînent des coûts de jetons supplémentaires conformément à la politique d'OpenAI.
Quelle est la fenêtre de contexte et le nombre maximal de jetons de sortie ?
La fenêtre de contexte est de 128 000 tokens. La sortie maximale est de 16 384 tokens. Cela permet le traitement de longs documents ou conversations et la génération de réponses substantielles.
Quels sont les principaux atouts de ce modèle ?
Il offre un raisonnement mathématique solide (79.5 sur MATH-500), une entrée multimodale (texte, images, fichiers), une grande fenêtre de contexte, et la génération de haute qualité d'OpenAI. Il est bien adapté pour les tâches de raisonnement complexe et de vision.
Comment ce modèle se compare-t-il à un modèle moins cher comme GPT-4o mini ?
GPT-4o (2024-08-06) est plus cher mais généralement plus performant dans les tâches de raisonnement et multimodales. GPT-4o mini est moins cher (0,15 $ / 0,60 $ pour 1 million de jetons) et suffisant pour les tâches simples. Choisissez en fonction de la complexité de la tâche et du budget.
Quelles politiques de traitement des données s'appliquent ?
Vos données sont envoyées à OpenAI pour traitement. OrcaRouter ne stocke pas les prompts. Les politiques d'utilisation des données d'OpenAI s'appliquent. Utilisez le routage multi-fournisseur d'OrcaRouter pour diriger les requêtes vers des fournisseurs répondant à vos exigences de conformité.
Puis-je utiliser ce modèle avec le client Python OpenAI ?
Oui, en définissant l'URL de base sur https://api.orcarouter.ai/v1 et en utilisant l'ID de modèle "openai/gpt-4o-2024-08-06". Votre code existant pour ChatCompletion, le streaming et l'appel de fonction fonctionne sans modifications.
Comment envoyer des images via l'API ?
Inclure l'image sous forme de chaîne encodée en base64 ou d'URL dans le tableau de contenu d'un message, en utilisant le format "image_url" avec le paramètre de détail. Le modèle interprète les images pour analyse. Cela suit le format de l'API multimodale d'OpenAI.
Quelle est la sortie maximale qui peut être générée par requête ?
La sortie maximale est de 16,384 tokens. Utilisez le paramètre max_tokens pour contrôler la longueur de la réponse. Soyez conscient que des sorties plus longues augmentent le coût et la latence.
Ce modèle est-il disponible en streaming ?
Oui, lors de l'utilisation de l'API compatible avec OpenAI, vous pouvez définir stream=True pour recevoir les réponses de manière incrémentielle. Cela fonctionne avec le endpoint d'OrcaRouter.
Puis-je utiliser ce modèle gratuitement ou avec un essai ?
Le modèle est facturé aux tarifs du fournisseur. OrcaRouter peut offrir un niveau gratuit ou des crédits d'essai—consultez leur site Web pour les offres actuelles. L'utilisation au-delà des crédits gratuits entraîne les coûts standard par jeton.

Intégrer ce badge

OpenAI: GPT-4o (2024-08-06)$2.50/M in687ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) sur OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

Fiche du modèle en données

GET /api/public/models/openai/gpt-4o-2024-08-06Ouvrir
Lisible par machine:/llms.txt/llms-full.txt