GPT-4o mini Search Preview — это специализированная модель для веб-поиска в Chat Completions. Она обучена понимать и выполнять поисковые запросы в интернете.
GPT-4o-mini Search Preview — это вариант модели GPT-4o-mini от OpenAI, который включает встроенные возможности веб-поиска. Он предназначен для предоставления ответов, учитывающих информацию из…
Модель объединяет общее понимание и генерацию языка с возможностью живого веб-поиска. Она может отвечать на вопросы о недавних событиях, извлекать данные с конкретных сайтов и синтезировать информацию из нескольких онлайн-источников. Сохраняются стандартные возможности GPT-4o-mini: суммаризация текста, перевод, генерация кода, логическое рассуждение и творческое письмо. Функция поискового предпросмотра (search preview) добавляет возможность доступа к текущим новостям, котировкам акций, погоде, сведениям о товарах и другим чувствительным ко времени данным. Однако, поскольку модель оптимизирована на скорость и эффективность, глубина её рассуждений может быть ниже, чем у полной модели GPT-4o.
Модель превосходно работает в сценариях, где ответы зависят от изменяющейся или актуальной информации. Примеры включают живых агентов службы поддержки, которым необходимо проверять статус заказа или политику возврата, инструменты для создания контента, генерирующие сводки по актуальным темам, и исследовательских ассистентов, собирающих факты из нескольких онлайн-источников. Она также полезна для проверки утверждений на соответствие текущим данным, например, для проверки последнего объявления компании или спортивного счета. Благодаря относительно низкой стоимости и быстрому времени отклика она подходит для приложений с высокими объемами запросов, где ключевой функцией является привязка к веб-данным.
Если вашему приложению не требуется веб-поиск или актуальная информация, рассмотрите возможность использования базовой модели GPT-4o-mini без предпросмотра поиска. Базовая модель стоит ещё дешевле (такая же цена за токен, но без накладных расходов на поисковый поиск) и может быть быстрее для чисто разговорных задач. Для очень простых запросов, не требующих обширных знаний о мире, может быть достаточно меньших моделей, таких как GPT-4o-mini (базовая) или даже более старых моделей, например GPT-3.5 Turbo. Оцените, оправдывает ли функция предпросмотра поиска свою стоимость для вашего конкретного случая использования.
Предварительный просмотр поиска автоматически запускается моделью, когда она считает, что запросу нужна внешняя информация. Вам не нужно настраивать API поиска или передавать результаты поиска вручную. Однако вы можете влиять на поведение модели, явно указав ей использовать веб-поиск или указав источники. Модель соблюдает стандартные фильтры безопасности и контента, применяемые OpenAI. Обратите внимание, что веб-поиск может увеличить задержку по сравнению с базовой моделью, поскольку модель ожидает результаты поиска перед формированием окончательного ответа.
Конкретные бенчмарк-показатели для GPT-4o-mini Search Preview не были публично опубликованы как отдельная версия. Однако, основываясь на базовой GPT-4o-mini, можно ожидать, что эта модель покажет хорошие результаты на стандартных NLP-бенчмарках, таких как MMLU, HellaSwag и GSM8K, но, вероятно, с меньшей точностью, чем полная GPT-4o. Функция Search Preview может улучшить производительность на задачах, требующих актуальных знаний (например, вопросы о недавних событиях), но не меняет логических способностей базовой модели. Для фактической точности модель полагается на качество и своевременность извлекаемых веб-источников.
GPT-4o-mini Search Preview разработан для обеспечения низкой задержки по сравнению с GPT-4o. Базовая модель GPT-4o-mini известна быстрым выводом, а поисковый предпросмотр добавляет дополнительное время на веб-поиск. Общее время ответа зависит от таких факторов, как задержка сети, количество полученных результатов поиска и длина контекста. При типичном использовании ответы генерируются в течение нескольких секунд. Для приложений, требующих абсолютно минимальной задержки, базовая GPT-4o-mini (без поиска) будет быстрее. API OrcaRouter поддерживает потоковую передачу для отображения токенов по мере их генерации.
Сильные стороны: Модель предоставляет актуальную информацию без отдельной поисковой интеграции, имеет большой контекст (128k токенов) и экономически эффективна при высоких объёмах использования. Ограничения: Принимает только текст; иногда может извлекать неполный или нерелевантный веб-контент; глубина рассуждений уступает GPT-4o; а предпросмотр результатов поиска может увеличивать задержку. Кроме того, модель не всегда явно указывает источники, поэтому пользователям следует проверять критически важную информацию. Она не предназначена для задач вроде мультимодального понимания, сложной математики или многошаговых цепочек рассуждений, где GPT-4o показывает лучшие результаты.
OrcaRouter выставляет счёт за GPT-4o-mini Search Preview по тарифу провайдера с нулевой наценкой: $0,15 за миллион входных токенов и $0,60 за миллион выходных токенов. То есть вы платите ровно столько, сколько взимает OpenAI, без дополнительных комиссий. Ценообразование идёт за токен, при этом контекстные токены считаются входными, а сгенерированные — выходными. Модель использует стандартную схему токенизации OpenAI. За саму функцию Search Preview не взимается дополнительная плата: стоимость такая же, как и у базового GPT-4o-mini, несмотря на дополнительный поиск в интернете.
По сравнению с GPT-4o (который стоит $2.50 за миллион входных токенов и $10 за миллион выходных токенов), GPT-4o-mini Search Preview значительно дешевле — примерно в 16 раз дешевле для входных и в 16,6 раз дешевле для выходных токенов. Это делает его хорошим кандидатом для приложений, где важна стоимость запроса, особенно если требуется веб-поиск. Однако базовая версия GPT-4o-mini (без предпросмотра поиска) стоит столько же за токен, но не имеет возможности поиска. Если поиск не нужен, можно сэкономить на небольшой дополнительной задержке, но стоимость за токен идентична.
OrcaRouter может поддерживать кэширование результатов поиска или ответов модели в зависимости от конфигурации. Если эта функция включена, повторные запросы одной и той же информации могут обслуживаться из кэша, что снижает задержку и использование токенов. Однако политики кэширования различаются. Для получения самой актуальной информации модель обычно выполняет новый веб-поиск при каждом запросе. Чтобы минимизировать затраты, рассмотрите возможность использования базовой GPT-4o-mini, если ваши запросы не требуют веб-данных. Всегда отслеживайте использование токенов через панель управления OrcaRouter, чтобы понимать свои расходы.
OrcaRouter передаёт точные цены OpenAI без какой-либо наценки. Выставление счетов происходит на основе количества токенов, сообщаемого провайдером. Нет платы за настройку, минимальных ежемесячных платежей или дополнительных сборов за использование API-шлюза. Вы платите только за использованные токены по указанным тарифам. Для GPT-4o-mini Search Preview это $0,15 за миллион входных токенов и $0,60 за миллион выходных токенов. Убедитесь, что ваша учётная запись настроена в OrcaRouter для доступа к модели по этим ставкам.
Чтобы использовать модель, отправьте POST-запрос на https://api.orcarouter.ai/v1/chat/completions с полем model, установленным в "openai/gpt-4o-mini-search-preview". Эта конечная точка совместима с OpenAI, поэтому вы можете использовать любой SDK или клиент OpenAI, изменив базовый URL и ключ API. Пример curl: curl https://api.orcarouter.ai/v1/chat/completions \ -H "Authorization: Bearer YOUR_ORCAROUTER_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "openai/gpt-4o-mini-search-preview", "messages": [{"role": "user", "content": "What is the current weather in London?"}] }' Поисковый предпросмотр будет запущен автоматически.
API поддерживает все стандартные параметры завершения чата OpenAI: temperature (0-2, по умолчанию 1), top_p, n, stream, stop, max_tokens (до 16384), presence_penalty, frequency_penalty и logit_bias. Модель учитывает эти параметры. Для предварительного просмотра поиска дополнительные параметры не требуются; модель решает, когда выполнять поиск. Однако вы можете подсказать модели явно запросить поиск в интернете (например, «Найди в интернете последние новости о...»), чтобы стимулировать получение информации. Учтите, что модель может всё же решить не выполнять поиск, если сочтёт свои внутренние знания достаточными.
Если вы уже используете API OpenAI, переход на OrcaRouter прост: измените базовый URL с https://api.openai.com/v1 на https://api.orcarouter.ai/v1 и замените ваш API-ключ на ключ от OrcaRouter. Идентификатор модели становится "openai/gpt-4o-mini-search-preview". Все остальные тела запросов и форматы ответов остаются неизменными. Вы можете использовать любую клиентскую библиотеку OpenAI (Python, Node.js и т.д.) без изменений. OrcaRouter также поддерживает стриминг, вызов функций и другие продвинутые функции, совместимые с API OpenAI.
Чтобы получать потоковые ответы, укажите "stream": true в вашем запросе. OrcaRouter возвращает данные в виде server-sent events, идентично формату потоковой передачи OpenAI. Каждое событие содержит дельту ответа. Потоковая передача особенно полезна для приложений, ориентированных на пользователя, чтобы показывать токены по мере их генерации. Для запросов предварительного просмотра поиска модель может сначала указать, что она выполняет поиск, прежде чем выдать окончательный ответ. Поток будет включать эти промежуточные токены. Убедитесь, что ваш клиент корректно обрабатывает частичные обновления.
GPT-4o-mini Search Preview — это более компактная, быстрая и дешёвая версия GPT-4o с дополнительными возможностями веб-поиска. В то время как GPT-4o обладает превосходными способностями к рассуждению, большей базой знаний (до даты её обучения) и мультимодальной поддержкой (изображения, аудио), эта модель работает только с текстом и полагается на веб-поиск, чтобы компенсировать ограниченность своих обучающих данных. Для задач, требующих глубокого анализа или сложных математических вычислений, лучше подходит GPT-4o. Для приложений, чувствительных к стоимости и нуждающихся в свежей информации, GPT-4o-mini Search Preview является сильной альтернативой. Цена примерно в 16 раз ниже.
Базовая модель GPT-4o-mini не включает поиск в интернете; она полагается исключительно на свои обучающие данные, актуальные до конца 2023 года. GPT-4o-mini Search Preview добавляет возможность получать текущую информацию из интернета. Обе модели имеют одинаковое окно контекста (128k токенов), максимальный вывод (16384) и ценообразование за токен. Вариант с поиском может иметь немного большую задержку из-за извлечения данных из сети. Если вашему приложению не нужны свежие данные, базовая модель функционально идентична и может быть быстрее. Обе модели доступны через OrcaRouter с разными идентификаторами моделей.
Другие модели с поддержкой поиска включают Gemini с привязкой к Google Search, или модели, использующие поиск в интернете через плагины. GPT-4o-mini Search Preview обеспечивает нативную интеграцию без внешних плагинов. Обычно она дешевле, чем более крупные модели с поддержкой поиска (например, GPT-4 с просмотром веб-страниц). Однако она может быть менее всеобъемлющей в результатах поиска по сравнению с выделенными поисковыми API. Для получения высокоточных веб-знаний рассмотрите возможность дополнения фактическим поисковым API и передачи результатов базовой модели. Эта модель лучше всего подходит для простых и умеренно сложных запросов, которые выигрывают от актуальных веб-данных.
Выберите эту модель, если вам нужно: (1) низкая стоимость за запрос, (2) автоматический веб-поиск без пользовательской интеграции, (3) высокая скорость ответов и (4) большой контекстный окно. Выберите полный вариант GPT-4o, если вам нужны мультимодальные входные данные или более глубокие рассуждения. Выберите базовую GPT-4o-mini, если вам не нужен веб-поиск и вы хотите немного более быстрых ответов. Выберите специализированный поисковый API плюс небольшую модель, если вам нужен точный контроль над источниками и результатами поиска. Эта модель лучше всего подходит как замена «из коробки» для GPT-3.5 или GPT-4o-mini в приложениях, которые выигрывают от использования актуальной информации.
Совместимо с OpenAI — оставьте свой SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-mini-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Ввод / 1M токенов | $0.150 |
| Вывод / 1M токенов | $0.600 |
| Валюта | USD |
Оценка по прайс-листу
Только оценка — фактическое число токенов зависит от токенизатора провайдера.
GET /api/public/models/openai/gpt-4o-mini-search-previewОткрыть @misc{orcarouter_gpt_4o_mini_search_preview,
title = {GPT-4o-mini Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview}
}OpenAI. (2025). GPT-4o-mini Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview