GPT-4o-mini Search Preview

openai/gpt-4o-mini-search-preview
JSON
por OpenAI · 2025-03-12

GPT-4o mini Search Preview é um modelo especializado para pesquisa na web em Chat Completions. Ele é treinado para entender e executar consultas de pesquisa na web.

ctx128K tokens
Saída máx.16.4K
Entradatext
Saídatext
ENTRADA$0.15/ 1M tokens
SAÍDA$0.60/ 1M tokens
p50 TTFTColetando…
p95 TTFTColetando…
TRÁFEGOColetando…

O GPT-4o-mini Search Preview é uma variante do modelo GPT-4o-mini da OpenAI que inclui capacidades integradas de pesquisa na web. Ele foi projetado para fornecer respostas que incorporam informações…

O que é GPT-4o-mini Search Preview?

Quem deve usar este modelo?

Principais especificações

Como funciona a pré-visualização da pesquisa?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-search-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • max_tokens
  • response_format
  • stream
  • structured_outputs
  • web_search_options

Preços

Entrada / 1M tokens$0.150
Saída / 1M tokens$0.600
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $2.85

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000302

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
Coletando…
Velocidade de saída
Coletando…
p95 TTFT
Coletando…
Taxa de erro
Coletando…

Benchmarks públicos

Fonte: Design Arena

Comparativo

GPT-4o-mini Search PreviewGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.15$21.00$60.00$5.00
Saída $/M$0.60$168.00$270.00$30.00
Contexto128K400K1.1M
Qualidade2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo para usar o GPT-4o-mini Search Preview no OrcaRouter?
O preço é de $0,15 por milhão de tokens de entrada e $0,60 por milhão de tokens de saída, cobrados à taxa do provedor com margem zero. Você paga exatamente o que a OpenAI cobra, sem taxas adicionais.
Qual é a janela de contexto e o comprimento máximo de saída?
A janela de contexto é de 128,000 tokens. O comprimento máximo de saída é de 16,384 tokens. O modelo aceita apenas entradas de texto.
Quais são as principais vantagens do GPT-4o-mini Search Preview?
Seus pontos fortes incluem pesquisa web integrada para informações atualizadas, grande janela de contexto, inferência rápida em comparação com GPT-4o e baixo custo. É ideal para aplicações que precisam de dados atuais sem APIs de busca separadas.
Como ele se compara ao GPT-4o-mini base?
Ambos têm preços e especificações idênticas, exceto que a variante Search Preview pode realizar pesquisas na web. O modelo base depende apenas dos seus dados de treinamento. Escolha Search Preview se precisar de informações em tempo real; caso contrário, o modelo base oferece desempenho similar pelo mesmo preço.
O OrcaRouter treina com meus dados?
OrcaRouter não utiliza dados de clientes para treinamento. O manuseio de dados segue as políticas da OpenAI e da OrcaRouter. Normalmente, os dados não são usados para melhorar modelos, a menos que haja consentimento explícito. Consulte a política de privacidade da OrcaRouter para obter detalhes.
Como faço para chamar o modelo via API do OrcaRouter?
Use a URL base https://api.orcarouter.ai/v1 com um cliente compatível com OpenAI. Defina o parâmetro model como "openai/gpt-4o-mini-search-preview". Inclua sua chave de API do OrcaRouter no cabeçalho Authorization. Todos os parâmetros padrão de conclusão de chat são suportados.
Que tipos de consultas ativam a pré-visualização da pesquisa?
O modelo decide automaticamente quando pesquisar na web, tipicamente para perguntas sobre eventos recentes, dados atuais ou informações que provavelmente mudaram desde sua data de corte de treinamento. Você também pode solicitar explicitamente que ele pesquise tópicos específicos.
Há alguma latência adicional para a pré-visualização de pesquisa?
Sim, a recuperação da web adiciona alguma latência em comparação com o GPT-4o-mini base. Os tempos de resposta típicos são de alguns segundos. Você pode usar streaming para mostrar respostas parciais.

Incorporar este selo

OpenAI: GPT-4o-mini Search Preview$0.15/M invia OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg" alt="OpenAI: GPT-4o-mini Search Preview no OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini Search Preview](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-4o-mini-search-previewAbrir
Legível por máquina:/llms.txt/llms-full.txt