GPT-4o Search Preview to wyspecjalizowany model do wyszukiwania w sieci w ramach Chat Completions. Jest wytrenowany do rozumienia i wykonywania zapytań wyszukiwania w sieci.
GPT-4o Search Preview to model tekstowy od OpenAI, oferowany jako część rodziny GPT-4o. Jest dostępny przez API OrcaRouter pod bazowym URL https://api.orcarouter.ai/v1 z identyfikatorem modelu…
Model jest dobrze przystosowany do zadań wymagających wnioskowania na długich sekwencjach tekstu, takich jak streszczanie, odpowiadanie na pytania z dużych dokumentów oraz generowanie spójnych odpowiedzi w rozbudowanych dialogach. Ze względu na etykietę 'search preview label' prawdopodobnie skutecznie obsługuje agregację wyników wyszukiwania i kontekstowe pobieranie informacji. Jego duże okno kontekstowe umożliwia analizę całych raportów, książek lub baz kodu w jednym poleceniu.
Głównym ograniczeniem jest brak wsparcia multimodalnego. Nie może przetwarzać obrazów, dźwięku ani filmów, co ogranicza jego zastosowanie w takich aplikacjach jak wizualne odpowiadanie na pytania czy transkrypcja mowy. Ponadto nie są dostępne żadne oficjalne wyniki benchmarków ani dane dotyczące opóźnień, co utrudnia porównanie wydajności w konkretnych zadaniach. Model może nie być zoptymalizowany do zadań wykraczających poza wnioskowanie tekstowe.
Dla zadań o niewielkich wymaganiach dotyczących kontekstu (np. prosta klasyfikacja, generowanie krótkiego tekstu), tańszy i szybszy model, taki jak GPT-3.5 Turbo, może być bardziej opłacalny. Jeśli potrzebne są dane multimodalne, rozważ standardowy model GPT-4o. W przypadku bardzo dużych obciążeń tekstowych, oceń, czy cennik bez marży w OrcaRouter uzasadnia koszt na token w porównaniu z innymi dostawcami.
Nie. GPT-4o Search Preview akceptuje tylko dane wejściowe tekstowe. Nie obsługuje obrazów, dźwięku ani wideo. To kluczowa różnica w stosunku do standardowego modelu GPT-4o, który jest multimodalny. Użytkownicy wymagający zrozumienia wizualnego lub dźwiękowego powinni wybrać inny model.
OpenAI nie opublikowało żadnych wyników benchmarków specyficznych dla wariantu GPT-4o Search Preview. Ponieważ jest on częścią rodziny GPT-4o, może dzielić charakterystyki wydajności z GPT-4o w zadaniach rozumienia języka, ale nie podano oficjalnych danych. Użytkownicy są proszeni o przeprowadzenie własnych ocen na reprezentatywnych zbiorach danych w celu określenia przydatności.
Dane dotyczące opóźnienia i przepustowości nie są publicznie udokumentowane dla GPT-4o Search Preview. Jako wariant modelu GPT-4o, prawdopodobnie ma podobne czasy odpowiedzi do standardowego modelu GPT-4o, ale rzeczywista wydajność zależy od czynników takich jak współbieżność żądań, liczba tokenów i infrastruktura OrcaRouter. Użytkownicy powinni przeprowadzać benchmarki przy użyciu własnego obciążenia.
Poza brakiem wsparcia multimodalnego, model nie publikuje wyników benchmarków ani gwarancji opóźnień. Oznaczenie "podgląd wyszukiwania" sugeruje optymalizację pod kątem zadań związanych z wyszukiwaniem, ale zakres tej optymalizacji nie jest określony. Użytkownicy nie powinni zakładać, że przewyższy on standardowy model GPT-4o w zadaniach niezwiązanych z wyszukiwaniem. Ponadto nie ma gwarancji niższej ceny ani lepszej wydajności w porównaniu do innych wariantów GPT-4o.
Cena wynosi $2.50 za 1 milion tokenów wejściowych i $10.00 za 1 milion tokenów wyjściowych. OrcaRouter pobiera dokładnie stawkę dostawcy z zerową marżą. Żadne dodatkowe opłaty nie są naliczane. Zużycie tokenów jest rozliczane oddzielnie dla wejścia i wyjścia. Te stawki są zgodne ze standardową ceną OpenAI za GPT-4o na ich platformie.
W porównaniu do wielu innych modeli, GPT-4o Search Preview jest wyceniony na poziomie premium za token, typowym dla modeli o wysokich możliwościach. Na przykład GPT-3.5 Turbo jest znacznie tańszy. Polityka zerowej marży na OrcaRouter gwarantuje, że użytkownicy płacą tyle samo, co przy bezpośrednim fakturowaniu OpenAI, ale bez żadnych dodatkowych kosztów. Może to być korzystne dla aplikacji wrażliwych na koszty, gdzie wymagany jest duży kontekst okna.
OrcaRouter nie reklamuje publicznie żadnych zniżek na cachowanie ani programów oszczędzania tokenów przeznaczonych specjalnie dla GPT-4o Search Preview. Użytkownicy są rozliczani na podstawie całkowitej liczby tokenów wejściowych i wyjściowych. Aby zarządzać kosztami, warto rozważyć optymalizację długości promptów i ograniczenie tokenów wyjściowych. Przetwarzanie wsadowe może poprawić wydajność, ale nie jest wspomniane w dostępnej dokumentacji.
Model jest dostępny przez zgodne z OpenAI API OrcaRouter. Ustaw bazowy URL na https://api.orcarouter.ai/v1 i dołącz ID modelu "openai/gpt-4o-search-preview" do swojego zapytania. Używaj standardowych bibliotek klienta OpenAI (np. pakiet openai w Pythonie) ze swoim kluczem API OrcaRouter. Przykład: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Ponieważ API jest kompatybilne z OpenAI, dostępne są standardowe parametry: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream i inne. Parametr max_tokens nie może przekraczać limitu 16 384 tokenów na wyjściu. Model nie obsługuje wejść multimodalnych, więc wiadomości powinny zawierać tylko treść tekstową.
Aby przełączyć się z innego wariantu GPT-4o (np. "gpt-4o" lub "gpt-4o-mini"), wystarczy zmienić identyfikator modelu w wywołaniu API na "openai/gpt-4o-search-preview". Upewnij się, że Twoje żądania zawierają wyłącznie treść tekstową, ponieważ ten wariant nie akceptuje obrazów ani dźwięku. W razie potrzeby dostosuj parametr max_tokens. Nie są wymagane żadne inne zmiany w kodzie.
Uwierzytelnianie odbywa się za pomocą kluczy API. Potrzebujesz klucza API OrcaRouter, który jest przekazywany w nagłówku żądania (zazwyczaj jako "Authorization: Bearer <your_key>"). Uzyskaj klucz z platformy OrcaRouter. To samo uwierzytelnianie jest używane dla wszystkich modeli dostępnych przez bramę.
GPT-4o Search Preview jest wersją tekstową, podczas gdy standardowe GPT-4o obsługuje tekst, obrazy i dźwięk. Wariant podglądu wyszukiwania może mieć ukryte optymalizacje pod kątem zapytań wyszukiwania, ale nie są one publicznie udostępniane. Ceny są identyczne: $2,50/M za wejście i $10/M za wyjście. Oba wykorzystują okno kontekstowe 128k i maksymalną długość odpowiedzi 16k. Głównym kompromisem jest obsługa modalności a potencjalnie wyspecjalizowana wydajność wyszukiwania.
GPT-4 Turbo (128k kontekst, tekst+obraz) jest poprzednikiem GPT-4o. GPT-4o Search Preview jest nowszy i należy do rodziny GPT-4o, która ogólnie oferuje lepsze wnioskowanie i wydajność niż GPT-4 Turbo. Jednak wsparcie multimodalne w GPT-4 Turbo ogranicza się do obrazów, podczas gdy GPT-4o jest w pełni multimodalne. Search Preview usuwa tę przewagę. Ceny GPT-4 Turbo wynoszą zazwyczaj $10/M za wejście i $30/M za wyjście, co sprawia, że Search Preview jest tańszy (przy podanych stawkach). Należy zauważyć, że ceny GPT-4 Turbo nie są tu podane; to ogólna wiedza.
Inne modele skoncentrowane na wyszukiwaniu (np. dedykowane systemy generacji wspomaganej wyszukiwaniem) mogą oferować wbudowane wyszukiwanie w sieci lub pobieranie plików. GPT-4o Search Preview nie zawiera własnej funkcji wyszukiwania; jest to model językowy, który może przetwarzać wyniki wyszukiwania dostarczone w podpowiedzi. Jeśli potrzebujesz zewnętrznego pobierania, połącz ten model z API wyszukiwania. Jego duże okno kontekstowe sprawia, że nadaje się do agregowania wielu wyników wyszukiwania w jednym żądaniu.
Podstawowym kompromisem jest równowaga między obsługą modalności a potencjalną optymalizacją zadań wyszukiwania. Zyskujesz duże okno kontekstowe i zerową marżę cenową, ale tracisz możliwość przetwarzania obrazów lub dźwięku. W znanych benchmarkach wydajność może być równoważna z GPT-4o, ale nie są dostępne konkretne wyniki. W przypadku zadań tekstowych, które korzystają z kontekstu 128k, ten model jest opłacalnym wyborem w rodzinie GPT-4o.
Zgodne z OpenAI — zostań przy swoim SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Wejście / 1M tokenów | $2.50 |
| Wyjście / 1M tokenów | $10.00 |
| Waluta | USD |
Szacunek na podstawie cennika
Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.
GET /api/public/models/openai/gpt-4o-search-previewOtwórz @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview