GPT-4o Search Preview é um modelo especializado para pesquisa na web em Chat Completions. Ele é treinado para entender e executar consultas de pesquisa na web.
GPT-4o Search Preview é um modelo apenas de texto da OpenAI, oferecido como parte da família GPT-4o. Ele é acessível via API da OrcaRouter na URL base https://api.orcarouter.ai/v1 sob o identificador…
O modelo é bem adequado para tarefas que exigem raciocínio sobre longas sequências de texto, como sumarização, respostas a perguntas a partir de grandes documentos e geração de respostas coerentes em diálogos extensos. Dado seu rótulo de pré-visualização de busca, provavelmente lida de forma eficaz com a agregação de resultados de pesquisa e recuperação contextual. Sua ampla janela de contexto permite a análise de relatórios inteiros, livros ou bases de código em um único prompt.
A principal limitação é a falta de suporte multimodal. Ela não pode processar entradas de imagem, áudio ou vídeo, o que restringe seu uso em aplicações como resposta visual a perguntas ou transcrição de fala. Além disso, não existem pontuações oficiais de benchmark ou dados de latência disponíveis, dificultando a comparação de desempenho em tarefas específicas. O modelo pode não ser otimizado para tarefas fora do raciocínio baseado em texto.
Para tarefas com requisitos de contexto pequenos (por exemplo, classificação simples, geração de texto curto), um modelo mais barato e rápido, como GPT-3.5 Turbo, pode ser mais econômico. Se forem necessárias entradas multimodais, considere o modelo padrão GPT-4o. Para cargas de trabalho de apenas texto com volume extremamente alto, avalie se o markup zero no OrcaRouter justifica o custo por token em comparação com outros provedores.
Não. O GPT-4o Search Preview aceita apenas entradas de texto. Ele não suporta imagens, áudio ou vídeo. Esse é um diferencial importante em relação ao modelo padrão GPT-4o, que é multimodal. Usuários que precisam de compreensão visual ou auditiva devem selecionar um modelo diferente.
OpenAI não publicou nenhuma pontuação de benchmark especificamente para a variante GPT-4o Search Preview. Como faz parte da família GPT-4o, pode compartilhar características de desempenho com GPT-4o em tarefas de compreensão de linguagem, mas nenhum número oficial é fornecido. Os usuários são aconselhados a realizar suas próprias avaliações em conjuntos de dados representativos para determinar a adequação.
As figuras de latência e taxa de transferência não são documentadas publicamente para o GPT-4o Search Preview. Como uma variante do GPT-4o, é provável que tenha tempos de resposta semelhantes ao modelo padrão GPT-4o, mas o desempenho real depende de fatores como concorrência de solicitações, contagem de tokens e infraestrutura do OrcaRouter. Os usuários devem realizar benchmarks usando sua própria carga de trabalho.
Além da ausência de suporte multimodal, o modelo não possui benchmarks publicados e garantias de latência. Sua designação de pré-visualização de busca implica otimização para tarefas relacionadas à pesquisa, mas a extensão dessa otimização não é especificada. Os usuários não devem presumir que ele superará o GPT-4o padrão em tarefas que não sejam de busca. Além disso, não há garantia de preços mais baixos ou eficiência aprimorada em comparação com outras variantes do GPT-4o.
O preço é de $2,50 por 1 milhão de tokens de entrada e $10,00 por 1 milhão de tokens de saída. A OrcaRouter cobra exatamente a taxa do provedor, sem margem de lucro. Nenhuma taxa adicional é aplicada. O uso de tokens é faturado separadamente para entrada e saída. Essas taxas são consistentes com o preço padrão do GPT-4o da OpenAI em sua plataforma.
Em comparação com muitos outros modelos, o GPT-4o Search Preview está posicionado a uma taxa premium por token, típica de modelos de alta capacidade. Por exemplo, o GPT-3.5 Turbo é significativamente mais barato. A política de markup zero no OrcaRouter garante que os usuários paguem o mesmo que a cobrança direta da OpenAI, mas sem nenhum custo adicional. Isso pode ser vantajoso para aplicações sensíveis a custos onde uma grande janela de contexto é necessária.
OrcaRouter não anuncia publicamente nenhum desconto de cache ou programas de economia de tokens especificamente para o GPT-4o Search Preview. Os usuários são cobrados com base no número total de tokens de entrada e saída consumidos. Para gerenciar custos, considere otimizar o comprimento dos prompts e limitar os tokens de saída. O processamento em lote pode melhorar a eficiência, mas não é mencionado na documentação disponível.
O modelo é acessado através da API compatível com OpenAI do OrcaRouter. Defina a URL base como https://api.orcarouter.ai/v1 e inclua o ID do modelo "openai/gpt-4o-search-preview" em sua solicitação. Use bibliotecas cliente padrão da OpenAI (ex.: pacote Python openai) com sua chave de API do OrcaRouter. Exemplo: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Como a API é compatível com OpenAI, parâmetros padrão estão disponíveis: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream e outros. O parâmetro max_tokens não deve exceder o limite de saída de 16.384 tokens. O modelo não suporta entradas multimodais, então as mensagens devem conter apenas conteúdo de texto.
Para alternar de outra variante do GPT-4o (por exemplo, "gpt-4o" ou "gpt-4o-mini"), basta alterar o ID do modelo na sua chamada de API para "openai/gpt-4o-search-preview". Certifique-se de que suas solicitações contenham apenas conteúdo de texto, pois essa variante não aceita imagens ou áudio. Ajuste o parâmetro max_tokens, se necessário. Nenhuma outra alteração de código é necessária.
A autenticação é feita por meio de chaves de API. Você precisa de uma chave de API do OrcaRouter, que é passada no cabeçalho da solicitação (geralmente como "Authorization: Bearer <your_key>"). Obtenha uma chave na plataforma OrcaRouter. A mesma autenticação é usada para todos os modelos acessíveis através do gateway.
GPT-4o Search Preview é apenas texto, enquanto o GPT-4o padrão suporta texto, imagens e áudio. A variante de pré-visualização de pesquisa pode ter otimizações subjacentes para consultas relacionadas a pesquisa, mas essas não são detalhadas publicamente. O preço é idêntico: $2.50/M de entrada e $10/M de saída. Ambos usam uma janela de contexto de 128k e saída máxima de 16k. A principal diferença é o suporte de modalidade versus um desempenho de pesquisa potencialmente especializado.
GPT-4 Turbo (contexto de 128k, texto+imagem) é um predecessor do GPT-4o. O GPT-4o Search Preview é mais recente e faz parte da família GPT-4o, que geralmente oferece raciocínio e eficiência melhorados em relação ao GPT-4 Turbo. No entanto, o suporte multimodal no GPT-4 Turbo é limitado a imagens, enquanto o GPT-4o é totalmente multimodal. O Search Preview remove essa vantagem. O preço do GPT-4 Turbo é tipicamente $10/M de entrada e $30/M de saída, tornando o Search Preview mais barato (se usando as taxas fornecidas). Observe que o preço do GPT-4 Turbo não é fornecido aqui; isso é conhecimento geral.
Outros modelos focados em pesquisa (por exemplo, sistemas dedicados de geração aumentada por recuperação) podem oferecer pesquisa web integrada ou recuperação de arquivos. O GPT-4o Search Preview não inclui sua própria funcionalidade de pesquisa; é um modelo de linguagem que pode processar resultados de pesquisa fornecidos no prompt. Se você precisar de recuperação externa, combine este modelo com uma API de pesquisa. Sua grande janela de contexto o torna adequado para agregar muitos resultados de pesquisa em uma única solicitação.
O principal trade-off está entre o suporte a modalidades e a potencial otimização de tarefas de busca. Você ganha uma grande janela de contexto e preço sem margem, mas perde a capacidade de processar imagens ou áudio. Em benchmarks conhecidos, o desempenho pode ser equivalente ao GPT-4o, mas nenhuma pontuação específica está disponível. Para tarefas apenas de texto que se beneficiam de um contexto de 128k, este modelo é uma escolha econômica dentro da família GPT-4o.
Compatível com OpenAI — mantenha seu SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Entrada / 1M tokens | $2.50 |
| Saída / 1M tokens | $10.00 |
| Moeda | USD |
Estimativa com base no preço de tabela
Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.
GET /api/public/models/openai/gpt-4o-search-previewAbrir @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview