GPT-4o Search Preview — это специализированная модель для веб-поиска в Chat Completions. Она обучена понимать и выполнять запросы веб-поиска.
GPT-4o Search Preview — это текстовая модель от OpenAI, предлагаемая в составе семейства GPT-4o. Доступ к ней осуществляется через API OrcaRouter по базовому URL https://api.orcarouter.ai/v1 под…
Модель хорошо подходит для задач, требующих рассуждений на основе длинных текстовых последовательностей, таких как суммаризация, ответы на вопросы по большим документам и генерация связных ответов в продолжительных диалогах. Учитывая её метку предварительного просмотра поиска, она, вероятно, эффективно обрабатывает агрегацию результатов поиска и контекстное извлечение. Большое контекстное окно позволяет анализировать целые отчёты, книги или кодовые базы в одном запросе.
Основным ограничением является отсутствие мультимодальной поддержки. Модель не может обрабатывать изображения, аудио или видео, что ограничивает её применение в таких задачах, как визуальное ответы на вопросы или транскрипция речи. Кроме того, отсутствуют официальные бенчмарки или показатели задержки, что затрудняет сравнение производительности по конкретным задачам. Модель может быть не оптимизирована для задач, выходящих за рамки текстовых рассуждений.
Для задач с небольшими требованиями к контексту (например, простая классификация, короткая генерация текста) более дешевая и быстрая модель, такая как GPT-3.5 Turbo, может быть более экономически эффективной. Если требуются мультимодальные входные данные, рассмотрите стандартную модель GPT-4o. Для чрезвычайно высоконагруженных текстовых задач оцените, оправдывает ли нулевая наценка на OrcaRouter стоимость за токен по сравнению с другими провайдерами.
Нет. GPT-4o Search Preview принимает только текстовые вводы. Он не поддерживает изображения, аудио или видео. Это ключевое отличие от стандартной модели GPT-4o, которая является мультимодальной. Пользователям, которым требуется визуальное или слуховое восприятие, следует выбрать другую модель.
OpenAI не публиковал никаких бенчмарков специально для варианта GPT-4o Search Preview. Поскольку он является частью семейства GPT-4o, он может разделять характеристики производительности с GPT-4o в задачах понимания языка, однако официальные показатели не предоставлены. Пользователям рекомендуется проводить собственные оценки на репрезентативных наборах данных для определения пригодности.
Показатели задержки и пропускной способности не задокументированы публично для GPT-4o Search Preview. Как вариант GPT-4o, он, вероятно, имеет схожее время отклика со стандартной моделью GPT-4o, но фактическая производительность зависит от таких факторов, как параллельность запросов, количество токенов и инфраструктура OrcaRouter. Пользователям следует проводить бенчмаркинг с использованием своей собственной нагрузки.
Помимо отсутствия поддержки мультимодальности, у модели нет опубликованных результатов тестов и гарантий задержки. Обозначение «поисковый предварительный просмотр» подразумевает оптимизацию для задач, связанных с поиском, но степень этой оптимизации не указана. Пользователи не должны предполагать, что она превзойдет стандартную GPT-4o в задачах, не связанных с поиском. Кроме того, нет гарантии более низкой цены или повышенной эффективности по сравнению с другими вариантами GPT-4o.
Цена составляет $2.50 за 1 миллион входных токенов и $10.00 за 1 миллион выходных токенов. OrcaRouter взимает плату точно по тарифу провайдера без наценки. Никаких дополнительных сборов не применяется. Использование токенов оплачивается отдельно для входных и выходных. Эти тарифы соответствуют стандартным ценам OpenAI на GPT-4o на их платформе.
По сравнению со многими другими моделями, GPT-4o Search Preview позиционируется по премиальной ставке за токен, что характерно для моделей с высокой производительностью. Например, GPT-3.5 Turbo значительно дешевле. Политика нулевой наценки в OrcaRouter гарантирует, что пользователи платят столько же, сколько при прямом выставлении счетов OpenAI, но без каких-либо дополнительных затрат. Это может быть выгодно для чувствительных к стоимости приложений, где требуется большое окно контекста.
OrcaRouter публично не рекламирует никаких скидок на кэширование или программ экономии токенов, специально предназначенных для GPT-4o Search Preview. Пользователи оплачиваются исходя из общего количества потребленных входных и выходных токенов. Для управления расходами рассмотрите возможность оптимизации длины подсказок и ограничения выходных токенов. Пакетная обработка может повысить эффективность, но не упоминается в доступной документации.
Модель доступна через совместимый с OpenAI API OrcaRouter. Установите базовый URL на https://api.orcarouter.ai/v1 и укажите идентификатор модели "openai/gpt-4o-search-preview" в вашем запросе. Используйте стандартные клиентские библиотеки OpenAI (например, пакет Python openai) с вашим ключом API OrcaRouter. Пример: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Поскольку API совместим с OpenAI, доступны стандартные параметры: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream и другие. Параметр max_tokens не должен превышать лимит вывода в 16 384 токена. Модель не поддерживает мультимодальные входные данные, поэтому сообщения должны содержать только текстовое содержимое.
Чтобы переключиться с другого варианта GPT-4o (например, «gpt-4o» или «gpt-4o-mini»), просто измените идентификатор модели в вашем API-запросе на «openai/gpt-4o-search-preview». Убедитесь, что ваши запросы содержат только текстовый контент, так как этот вариант не принимает изображения или аудио. При необходимости настройте параметр `max_tokens`. Никаких других изменений в коде не требуется.
Аутентификация осуществляется с помощью API-ключей. Вам потребуется ключ API OrcaRouter, который передается в заголовке запроса (обычно как "Authorization: Bearer <your_key>"). Получите ключ на платформе OrcaRouter. Та же аутентификация используется для всех моделей, доступных через шлюз.
GPT-4o Search Preview является только текстовым, в то время как стандартный GPT-4o поддерживает текст, изображения и аудио. Вариант с предварительным просмотром поиска может иметь базовые оптимизации для запросов, связанных с поиском, но они не раскрываются публично. Ценообразование идентично: $2.50/М ввод и $10/М вывод. Оба используют контекстное окно 128k и максимальный вывод 16k. Основной компромисс — поддержка модальности против потенциально специализированной производительности поиска.
GPT-4 Turbo (контекст 128k, текст+изображение) является предшественником GPT-4o. GPT-4o Search Preview — более новая модель, входящая в семейство GPT-4o, которое обычно предлагает улучшенные рассуждения и эффективность по сравнению с GPT-4 Turbo. Однако мультимодальная поддержка в GPT-4 Turbo ограничена изображениями, тогда как GPT-4o полностью мультимодальна. Search Preview устраняет это преимущество. Цены на GPT-4 Turbo обычно составляют $10/M за ввод и $30/M за вывод, что делает Search Preview дешевле (при использовании указанных тарифов). Обратите внимание, что цены на GPT-4 Turbo здесь не указаны; это общеизвестная информация.
Другие модели, ориентированные на поиск (например, специализированные системы генерации с дополнением поиска), могут предлагать встроенный веб-поиск или извлечение файлов. GPT-4o Search Preview не включает собственную функцию поиска; это языковая модель, которая может обрабатывать результаты поиска, предоставленные в промпте. Если вам нужен внешний поиск, комбинируйте эту модель с поисковым API. Его большое контекстное окно делает его подходящим для агрегации множества результатов поиска в одном запросе.
Основной компромисс заключается между поддержкой модальностей и потенциальной оптимизацией поисковых задач. Вы получаете большое окно контекста и ценообразование без наценки, но теряете возможность обработки изображений или аудио. На известных benchmarks производительность может быть эквивалентна GPT-4o, но конкретные показатели отсутствуют. Для текстовых задач, выигрывающих от контекста в 128k, эта модель является экономически эффективным выбором в семействе GPT-4o.
Совместимо с OpenAI — оставьте свой SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Ввод / 1M токенов | $2.50 |
| Вывод / 1M токенов | $10.00 |
| Валюта | USD |
Оценка по прайс-листу
Только оценка — фактическое число токенов зависит от токенизатора провайдера.
GET /api/public/models/openai/gpt-4o-search-previewОткрыть @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview