GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
VisãoFerramentasJSON
por OpenAI · 2024-08-06

A versão de 2024-08-06 do GPT-4o oferece desempenho aprimorado em saídas estruturadas, com a capacidade de fornecer um esquema JSON no respone_format. Leia mais [aqui](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" de "omni") é...

ctx128K tokens
Saída máx.16.4K
Entradatext + image + file
Saídatext
p50 TTFT2.00 s
ENTRADA$2.50/ 1M tokens
SAÍDA$10.00/ 1M tokens
p50 TTFT2.00 s7 d
p95 TTFT7.61 s7 d
TRÁFEGO207.0Ktokens / 7 d

GPT-4o (2024-08-06) é uma versão do modelo GPT-4o da OpenAI, lançada em agosto de 2024. É um modelo de linguagem grande multimodal que processa entradas de texto, imagem e arquivos. O modelo é…

O que é GPT-4o (2024-08-06)?

Para quem é este modelo?

Quais modalidades de entrada ele suporta?

Principais especificações de relance

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Preços

Entrada / 1M tokens$2.50
Saída / 1M tokens$10.00
Leitura de cache / 1M$1.25
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $47.50 · Com cache de prompt $43.13

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.005038

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
2.00 s
Velocidade de saída
477 tok/s
p95 TTFT
7.61 s
Taxa de erro
0%

Benchmarks públicos

16.6
AA Coding
Melhor que 12% dos modelos comparados
nº 108 de 123
9.6
AA Intelligence
Melhor que 10% dos modelos comparados
nº 110 de 125
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.9
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
35.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
Fonte: artificialanalysis.ai

Comparativo

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$2.50$21.00$60.00$5.00
Saída $/M$10.00$168.00$270.00$30.00
Contexto128K400K1.1M
Qualidade3/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo por token para GPT-4o (2024-08-06) no OrcaRouter?
Preço é $2.50 por 1 milhão de tokens de entrada e $10.00 por 1 milhão de tokens de saída, cobrados pela taxa do provedor OpenAI sem nenhum acréscimo da OrcaRouter. Entradas de imagens e arquivos incorrem em custos adicionais de tokens de acordo com a política da OpenAI.
O que é a janela de contexto e o número máximo de tokens de saída?
A janela de contexto tem 128.000 tokens. A saída máxima é de 16.384 tokens. Isso permite processar documentos ou conversas longas e gerar respostas substanciais.
Quais são os principais pontos fortes deste modelo?
Ele oferece forte raciocínio matemático (79,5 no MATH-500), entrada multimodal (texto, imagens, arquivos), uma grande janela de contexto e a geração de alta qualidade da OpenAI. É adequado para tarefas complexas de raciocínio e visão.
Como este modelo se compara a um modelo mais barato como o GPT-4o mini?
GPT-4o (2024-08-06) é mais caro, mas geralmente mais capaz em tarefas de raciocínio e multimodais. GPT-4o mini é mais barato ($0,15/$0,60 por 1M de tokens) e suficiente para tarefas simples. Escolha com base na complexidade da tarefa e no orçamento.
Quais políticas de tratamento de dados se aplicam?
Seus dados são enviados para a OpenAI para processamento. O OrcaRouter não armazena prompts. As políticas de uso de dados da OpenAI se aplicam. Use o roteamento multi-provedor do OrcaRouter para direcionar solicitações para provedores que atendam aos seus requisitos de conformidade.
Posso usar este modelo com o cliente Python da OpenAI?
Sim, definindo a URL base como https://api.orcarouter.ai/v1 e usando o ID do modelo "openai/gpt-4o-2024-08-06". Seu código existente para ChatCompletion, streaming e chamada de funções funciona sem alterações.
Como enviar entradas de imagem via API?
Inclua a imagem como uma string codificada em base64 ou URL no array de conteúdo de uma mensagem, usando o formato 'image_url' com o parâmetro detail. O modelo interpreta imagens para análise. Isso segue o formato da API multimodal da OpenAI.
Qual é a saída máxima que pode ser gerada por requisição?
A saída máxima é de 16.384 tokens. Use o parâmetro max_tokens para controlar o comprimento da resposta. Esteja ciente de que saídas mais longas aumentam o custo e a latência.
Este modelo está disponível para streaming?
Sim, ao usar a API compatível com OpenAI, você pode definir stream=True para receber respostas incrementalmente. Isso funciona com o endpoint do OrcaRouter.
Posso usar este modelo gratuitamente ou com uma avaliação?
O modelo é cobrado de acordo com as taxas do provedor. A OrcaRouter pode oferecer um nível gratuito ou créditos de teste — verifique o site deles para ofertas atuais. O uso além de quaisquer créditos gratuitos incorre nos custos padrão por token.

Incorporar este selo

OpenAI: GPT-4o (2024-08-06)$2.50/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) no OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-4o-2024-08-06Abrir
Legível por máquina:/llms.txt/llms-full.txt