openai/gpt-5.4-2026-03-05

openai/gpt-5.4-2026-03-05
VisãoFerramentasJSONRaciocínio
por openai

OpenAI GPT-5.4-2026-03-05: 1.05M de contexto, 128K de saída, 92.0 GPQA Diamond. Entrada de texto, imagem e arquivo.

ctx1M tokens
Saída máx.128K
Entradatext + image + file
Saídatext
p50 TTFT1.57 s
ENTRADA$2.50/ 1M tokens
SAÍDA$15.00/ 1M tokens
p50 TTFT1.57 s7 d
p95 TTFT2.87 s7 d
TRÁFEGO292.7Ktokens / 7 d

Este é um modelo de linguagem grande da OpenAI com uma janela de contexto de 1.050.000 tokens e uma saída máxima de 128.000 tokens. Ele aceita entradas de texto, imagem e arquivo, permitindo que os…

O que é openai/gpt-5.4-2026-03-05 e para quem é?

Quais formatos de entrada ele suporta?

Isso suporta instruções de sistema, temperatura e outros parâmetros?

Quais são as principais vantagens deste modelo em relação a alternativas menores?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-5.4-2026-03-05",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • include_reasoning
  • max_completion_tokens
  • max_tokens
  • reasoning
  • response_format
  • seed
  • stream
  • structured_outputs
  • tool_choice
  • tools

Preços

NívelEntrada / 1M tokensSaída / 1M tokensLeitura de cache / 1M
272K$2.50$15.00$0.250
$5.00$22.50$0.500
Nível selecionado pela contagem de tokens de entrada de cada solicitação

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $62.50 · Com cache de prompt $54.63

Estimativa com base no preço de tabela

Preços por níveis — esta estimativa usa as tarifas do nível base.

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.007537

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
1.57 s
Velocidade de saída
55.2 tok/s
p95 TTFT
2.87 s
Taxa de erro
0%

Benchmarks públicos

71.1
AA Coding
Melhor que 85% dos modelos comparados
nº 18 de 130
53.1
AA Intelligence
Melhor que 82% dos modelos comparados
nº 23 de 132
GPQA Diamond
92.0
Humanity's Last Exam
43.7
IFBench
73.9
Long-Context Recall
77.7
SciCode
56.6
tau_banking
39.6
TerminalBench Hard
57.6
terminalbench_v2_1
78.3
τ²-Bench
87.1
Fonte: artificialanalysis.ai

Atividade da comunidade

Do que os desenvolvedores estão falando esta semana

Hacker News0 menções · 7 d

Comparativo

openai/gpt-5.4-2026-03-05GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$2.50$21.00$60.00$5.00
Saída $/M$15.00$168.00$270.00$30.00
Contexto1.1M400K1.1M
Qualidade5/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Quanto custa usar openai/gpt-5.4-2026-03-05?
O preço não é divulgado publicamente nos fatos fornecidos. Para tarifas atuais por token, consulte o painel do OrcaRouter ou entre em contato com o suporte deles. Os custos provavelmente serão mais altos do que modelos menores devido à enorme capacidade de contexto e saída.
Qual é o tamanho da janela de contexto?
A janela de contexto é de 1.050.000 tokens. Isso inclui todos os tokens de entrada de texto, imagens e arquivos. A saída máxima é de 128.000 tokens.
Quais são os principais pontos fortes deste modelo?
Os pontos fortes incluem uma janela de contexto muito grande para processar documentos inteiros ou conversas longas, entrada multimodal (texto, imagem, arquivo), alto comprimento de saída e uma forte pontuação GPQA Diamond de 92.0 indicando raciocínio de nível de pós-graduação.
Como ele se compara ao GPT-4o?
Este modelo tem uma janela de contexto 8 vezes maior (1,05M vs 128K) e saída 8 vezes maior (128K vs 16K). Ele também obtém pontuações mais altas no GPQA Diamond (92 vs ~80). O GPT-4o pode ser mais barato e mais rápido para tarefas curtas.
Isso lida com imagens e arquivos?
Sim. As modalidades de entrada incluem texto, imagem e arquivo. Você pode enviar uma requisição com imagens (URLs ou base64) e arquivos (PDF, Word, etc.) junto com texto.
Como faço para chamá-lo do meu código?
Use a API compatível com OpenAI da OrcaRouter em base_url https://api.orcarouter.ai/v1 com o ID do modelo "openai/gpt-5.4-2026-03-05". Use qualquer biblioteca cliente OpenAI com a URL base modificada e sua chave de API OrcaRouter.
O que acontece com meus dados quando uso este modelo no OrcaRouter?
As políticas de tratamento de dados dependem dos termos da OrcaRouter e das políticas da OpenAI. Os fatos fornecidos não especificam detalhes de retenção de dados ou privacidade. Entre em contato com a OrcaRouter para saber sobre suas práticas de processamento de dados e privacidade.
É adequado para uso em produção?
Sim, mas avalie a latência e o custo para sua carga de trabalho específica. O grande contexto pode levar a respostas mais lentas e contas mais altas. Teste com uma amostra representativa antes da implantação completa.
Posso transmitir a saída?
Sim. Defina o parâmetro 'stream' como true na chamada da API. O modelo enviará Server-Sent Events à medida que os tokens forem gerados, assim como o streaming da OpenAI.
Qual é o comprimento máximo de saída?
A saída máxima é de 128,000 tokens. Defina o parâmetro 'max_tokens' até 128,000. O modelo parará de gerar quando atingir esse limite ou uma sequência de parada.

Incorporar este selo

openai/gpt-5.4-2026-03-05$2.50/M in1571ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-5.4-2026-03-05" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-5.4-2026-03-05.svg" alt="openai/gpt-5.4-2026-03-05 no OrcaRouter" /> </a>
Markdown [![openai/gpt-5.4-2026-03-05](https://www.orcarouter.ai/embed/openai/gpt-5.4-2026-03-05.svg)](https://www.orcarouter.ai/models/openai/gpt-5.4-2026-03-05)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-5.4-2026-03-05Abrir
Legível por máquina:/llms.txt/llms-full.txt