GPT-4o Search Preview ist ein spezialisiertes Modell für die Websuche in Chat Completions. Es ist darauf trainiert, Websuchanfragen zu verstehen und auszuführen.
GPT-4o Search Preview ist ein reines Textmodell von OpenAI, das als Teil der GPT-4o-Familie angeboten wird. Es ist über die API von OrcaRouter unter der Basis-URL https://api.orcarouter.ai/v1 mit der…
Das Modell eignet sich gut für Aufgaben, die Schlussfolgerungen über lange Textsequenzen erfordern, wie Zusammenfassung, Beantwortung von Fragen aus großen Dokumenten und das Generieren kohärenter Antworten in ausgedehnten Dialogen. Aufgrund seines Suchvorschau-Labels verarbeitet es wahrscheinlich effektiv die Aggregation von Suchergebnissen und kontextuelle Abfragen. Sein großes Kontextfenster ermöglicht die Analyse ganzer Berichte, Bücher oder Codebasen in einem einzigen Prompt.
Die Hauptbeschränkung ist das Fehlen multimodaler Unterstützung. Es kann keine Bilder, Audio- oder Videoeingaben verarbeiten, was seinen Einsatz in Anwendungen wie visueller Fragebeantwortung oder Sprachtranskription einschränkt. Zudem sind keine offiziellen Benchmark-Ergebnisse oder Latenzwerte verfügbar, was den Leistungsvergleich bei bestimmten Aufgaben erschwert. Das Modell ist möglicherweise nicht für Aufgaben außerhalb textbasierter Argumentation optimiert.
Für Aufgaben mit geringem Kontextbedarf (z. B. einfache Klassifikation, kurze Textgenerierung) kann ein günstigeres und schnelleres Modell wie GPT-3.5 Turbo kosteneffizienter sein. Falls multimodale Eingaben benötigt werden, ziehen Sie das Standardmodell GPT-4o in Betracht. Bei extrem hohen, rein textbasierten Arbeitslasten bewerten Sie, ob die Nullaufschlag-Preisgestaltung von OrcaRouter die Kosten pro Token im Vergleich zu anderen Anbietern rechtfertigt.
Nein. GPT-4o Search Preview akzeptiert nur Texteingaben. Es unterstützt keine Bilder, Audio oder Video. Dies ist ein wesentlicher Unterschied zum standardmäßigen GPT-4o Modell, welches multimodal ist. Benutzer, die visuelles oder auditives Verständnis benötigen, sollten ein anderes Modell auswählen.
OpenAI hat keine spezifischen Benchmark-Ergebnisse für die GPT-4o Search Preview-Variante veröffentlicht. Da sie Teil der GPT-4o-Familie ist, könnte sie in Bezug auf Sprachverständnisaufgaben ähnliche Leistungsmerkmale wie GPT-4o aufweisen, es werden jedoch keine offiziellen Zahlen bereitgestellt. Benutzern wird empfohlen, eigene Bewertungen auf repräsentativen Datensätzen durchzuführen, um die Eignung zu bestimmen.
Latenz- und Durchsatzwerte sind für GPT-4o Search Preview nicht öffentlich dokumentiert. Als Variante von GPT-4o dürfte es ähnliche Antwortzeiten wie das Standard-GPT-4o-Modell aufweisen, die tatsächliche Leistung hängt jedoch von Faktoren wie gleichzeitigen Anfragen, Tokenanzahl und der OrcaRouter-Infrastruktur ab. Benutzer sollten mit ihrer eigenen Arbeitslast Benchmarks durchführen.
Jenseits des Fehlens multimodaler Unterstützung weist das Modell keine veröffentlichten Benchmark-Ergebnisse oder Latenzgarantien auf. Die Kennzeichnung als Suchvorschau impliziert eine Optimierung für suchbezogene Aufgaben, jedoch ist das Ausmaß dieser Optimierung nicht spezifiziert. Benutzer sollten nicht davon ausgehen, dass es bei Nicht-Suchaufgaben das standardmäßige GPT-4o übertrifft. Zudem gibt es keine Garantie für niedrigere Preise oder verbesserte Effizienz im Vergleich zu anderen GPT-4o-Varianten.
Preisgestaltung: $2.50 pro 1 Million Eingabe-Tokens und $10.00 pro 1 Million Ausgabe-Tokens. OrcaRouter berechnet exakt den Anbieterpreis ohne Aufschlag. Es fallen keine zusätzlichen Gebühren an. Die Token-Nutzung wird getrennt für Eingabe und Ausgabe abgerechnet. Diese Preise entsprechen den Standardpreisen von OpenAI für GPT-4o auf deren Plattform.
Im Vergleich zu vielen anderen Modellen ist GPT-4o Search Preview zu einem Premium-Preis pro Token positioniert, der für leistungsstarke Modelle typisch ist. Beispielsweise ist GPT-3.5 Turbo deutlich günstiger. Die Null-Aufschlag-Politik von OrcaRouter stellt sicher, dass Nutzer denselben Preis wie bei direkter OpenAI-Abrechnung zahlen, jedoch ohne zusätzliche Gemeinkosten. Dies kann vorteilhaft für kostenbewusste Anwendungen sein, bei denen ein großer Kontextfenster erforderlich ist.
OrcaRouter wirbt öffentlich keine Caching-Rabatte oder Token-Sparprogramme speziell für GPT-4o Search Preview. Die Abrechnung erfolgt auf Basis der Gesamtzahl der verbrauchten Eingabe- und Ausgabe-Token. Zur Kostenkontrolle sollten Sie die Prompt-Längen optimieren und die Ausgabe-Token begrenzen. Batch-Verarbeitung kann die Effizienz verbessern, wird jedoch in der verfügbaren Dokumentation nicht erwähnt.
Das Modell wird über die OpenAI-kompatible API von OrcaRouter aufgerufen. Setzen Sie die Basis-URL auf https://api.orcarouter.ai/v1 und fügen Sie die Modell-ID "openai/gpt-4o-search-preview" in Ihre Anfrage ein. Verwenden Sie die standardmäßigen OpenAI-Clientbibliotheken (z.B. das Python-Paket openai) mit Ihrem OrcaRouter-API-Schlüssel. Beispiel: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Da die API OpenAI-kompatibel ist, sind Standardparameter verfügbar: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream und andere. Der Parameter max_tokens darf das Ausgabelimit von 16.384 Token nicht überschreiten. Das Modell unterstützt keine multimodalen Eingaben, daher sollten Nachrichten nur Textinhalt enthalten.
Um von einer anderen GPT-4o-Variante (z.B. "gpt-4o" oder "gpt-4o-mini") zu wechseln, ändern Sie einfach die Modell-ID in Ihrem API-Aufruf zu "openai/gpt-4o-search-preview". Stellen Sie sicher, dass Ihre Anfragen nur Textinhalte enthalten, da diese Variante keine Bilder oder Audiodateien akzeptiert. Passen Sie den max_tokens-Parameter bei Bedarf an. Es sind keine weiteren Codeänderungen erforderlich.
Die Authentifizierung erfolgt über API-Schlüssel. Sie benötigen einen OrcaRouter-API-Schlüssel, der im Request-Header übergeben wird (typischerweise als "Authorization: Bearer <your_key>"). Besorgen Sie sich einen Schlüssel von der OrcaRouter-Plattform. Dieselbe Authentifizierung wird für alle über das Gateway zugänglichen Modelle verwendet.
GPT-4o Search Preview ist nur Text, während das standardmäßige GPT-4o Text, Bilder und Audio unterstützt. Die Search Preview-Variante kann unter Umständen Optimierungen für suchbezogene Abfragen enthalten, diese werden jedoch nicht öffentlich detailliert. Die Preise sind identisch: 2,50 $/M Input und 10 $/M Output. Beide verwenden ein 128k-Kontextfenster und 16k maximalen Output. Der Hauptkompromiss besteht zwischen der Unterstützung von Modalitäten und potenziell spezialisierter Suchleistung.
GPT-4 Turbo (128k Kontext, Text+Bild) ist ein Vorgänger von GPT-4o. Die GPT-4o Search Preview ist neuer und Teil der GPT-4o-Familie, die im Allgemeinen verbesserte Argumentationsfähigkeit und Effizienz gegenüber GPT-4 Turbo bietet. Allerdings ist die multimodale Unterstützung bei GPT-4 Turbo auf Bilder beschränkt, während GPT-4o vollständig multimodal ist. Search Preview hebt diesen Vorteil auf. Die Preisgestaltung für GPT-4 Turbo beträgt typischerweise 10 $/M Eingabe und 30 $/M Ausgabe, was die Search Preview (bei Verwendung der angegebenen Sätze) günstiger macht. Beachten Sie, dass die Preisgestaltung für GPT-4 Turbo hier nicht angegeben ist; dies ist Allgemeinwissen.
Andere suchorientierte Modelle (z. B. dedizierte Retrieval-Augmented-Generation-Systeme) bieten möglicherweise eine integrierte Websuche oder Dateiabfrage. GPT-4o Search Preview verfügt über keine eigene Suchfunktion; es ist ein Sprachmodell, das in der Prompt bereitgestellte Suchergebnisse verarbeiten kann. Falls Sie eine externe Abfrage benötigen, kombinieren Sie dieses Modell mit einer Such-API. Sein großes Kontextfenster macht es geeignet, viele Suchergebnisse in einer einzigen Anfrage zu aggregieren.
Der grundlegende Kompromiss besteht zwischen der Unterstützung mehrerer Modalitäten und der möglichen Optimierung für Suchaufgaben. Sie erhalten ein großes Kontextfenster und Preise ohne Aufschlag, verlieren aber die Fähigkeit, Bilder oder Audio zu verarbeiten. Bei bekannten Benchmarks könnte die Leistung mit GPT-4o vergleichbar sein, aber es sind keine spezifischen Werte verfügbar. Für reine Textaufgaben, die von einem 128k Kontext profitieren, ist dieses Modell eine kosteneffiziente Wahl innerhalb der GPT-4o-Familie.
OpenAI-kompatibel — behalte dein bisheriges SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Eingabe / 1M Tokens | $2.50 |
| Ausgabe / 1M Tokens | $10.00 |
| Währung | USD |
Schätzung auf Basis des Listenpreises
Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.
GET /api/public/models/openai/gpt-4o-search-previewÖffnen @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview