Предварительный просмотр текстовой модели GPT-4o с контекстом 128K, выводом 16K, доступ через OrcaRouter API по цене $2.50/$10 за M токенов.
Эта модель представляет собой предварительную версию от OpenAI, ограниченную только текстовым вводом. Она имеет идентификатор openai/gpt-4o-search-preview-2025-03-11 при доступе через API OrcaRouter.…
Будучи текстовой версией предварительного просмотра GPT-4o, она отлично справляется с пониманием и генерацией естественного языка в широком спектре областей. Она может выполнять суммаризацию документов, ответы на вопросы, творческое письмо, перевод и генерацию кода. Большой контекстный окно позволяет сохранять связность на очень длинных отрывках, что делает её подходящей для таких задач, как анализ книг или обработка обширных логов. Она поддерживает сообщения системы, пользователя и ассистента в чат-подобном формате. Способности модели к обучению без примеров и с несколькими примерами типичны для моделей класса GPT-4, что позволяет ей справляться со сложными инструкциями без обширной тонкой настройки.
Если ваша задача не требует полной вычислительной мощности GPT-4o, рассмотрите возможность использования меньшей или более дешевой модели от OrcaRouter, например openai/gpt-4o-mini или gpt-3.5-turbo. Примеры задач, лучше подходящих для более дешевых моделей, включают простую классификацию, создание короткого контента или базовые вопросы и ответы с ограниченным контекстом. Стоимость предварительной модели может быть неоправданной для высокообъемных запросов с низкой сложностью. Кроме того, если требуется мультимодальный ввод, эта модель не может обрабатывать изображения или аудио; потребуется другая модель (например, стандартная GPT-4o или GPT-4V). Всегда оценивайте компромисс между качеством и стоимостью за токен.
Эта модель идентифицируется как вариант 'search-preview', но в общедоступных спецификациях не описаны конкретные возможности использования инструментов или веб-поиска. Она работает только с текстом и функционирует как стандартная языковая модель. Пользователям не следует предполагать наличие встроенных функций поиска или извлечения. Для дополненной генерации вы можете реализовать отдельные пайплайны для генерации с дополнением извлечением (RAG), передавая извлеченные документы в контекстное окно модели. OrcaRouter не добавляет никакого промежуточного программного обеспечения для использования инструментов; модель отвечает исключительно на основе своего обучения и предоставленного запроса. Будущие версии могут изменить это поведение, но на данный момент в предварительной версии интеграция инструментов не документирована.
В качестве предварительной версии эта модель может демонстрировать неожиданное поведение или меньшую надежность по сравнению со стабильными релизами. Она поддерживает только текст, поэтому любой мультимодальный запрос будет отклонен. Максимальный выходной объем в 16 384 токенов является значительным, но все же может обрезать очень длинные сгенерированные последовательности. Дата прекращения обучения и данные обучения модели не указаны; она может не знать о самых последних событиях. Использование в производственной среде не рекомендуется, так как модель может быть обновлена или удалена. Кроме того, из-за ее предварительного характера задержка может быть выше, чем у стабильных моделей. Всегда проводите тщательное тестирование перед развертыванием в масштабе.
Для этой предварительной версии не было предоставлено конкретных результатов бенчмарков. Как вариант GPT-4o, ожидается, что она будет работать аналогично стандартной GPT-4o в типовых языковых задачах, но точные цифры не разглашаются. Пользователи могут проводить собственные оценки с использованием публичных наборов данных. Большой контекстный окно даёт ей преимущество в бенчмарках на длинные документы, но поскольку это предварительная версия, результаты могут отличаться от производственной модели. За авторитетными цифрами обращайтесь к официальным отчётам OpenAI по бенчмаркам для GPT-4o. OrcaRouter не изменяет выходные данные или производительность модели.
Показатели задержки и пропускной способности для этой предварительной модели не были опубликованы. Будучи предварительной, она может быть медленнее стабильной GPT-4o из-за экспериментальной инфраструктуры. Время отклика зависит от длины входных данных, длины выходных данных и одновременного спроса. OrcaRouter не добавляет дополнительной задержки сверх обычной маршрутизации API. Для оценки скорости разработчики могут отправлять тестовые запросы с типичными нагрузками. Для производственных приложений, требующих стабильной производительности, рекомендуется использовать стабильную модель gpt-4o, если только не требуются специфические функции предварительной версии.
Модели класса GPT-4 известны своими сильными рассуждениями в различных областях, включая математику, логику и логические выводы на основе здравого смысла. Ожидается, что эта предварительная версия унаследует эти возможности. Большой контекст позволяет выполнять сложные цепочки рассуждений за много шагов, не теряя из виду предыдущие части. Однако для этой конкретной версии не предоставлены специальные бенчмарки для оценки рассуждений. Пользователям следует проверить производительность на своих собственных задачах в конкретной области. Модель также может демонстрировать улучшенное следование инструкциям по сравнению с более ранними версиями GPT, но опять же рекомендуется независимая проверка.
Помимо того что это предварительная версия, модель не поддерживает мультимодальность. Она не может напрямую обрабатывать изображения, аудио или видео. Дата отсечки знаний неизвестна, поэтому информация о событиях после обучения может отсутствовать. Лимит вывода в 16 384 токена, хотя и щедрый, не позволяет создавать чрезвычайно длинные тексты за одну генерацию; для более длинных выходных данных требуется итеративное prompting или разбивка. Предварительная версия также может иметь более высокий уровень ошибок или отказов для некоторых чувствительных тем. Производительность на языках, отличных от английского, может различаться. Всегда тестируйте на репрезентативных данных перед развертыванием.
Модель стоит $2.50 за 1 миллион токенов на вход и $10.00 за 1 миллион токенов на выход. Это тарифы провайдера OpenAI; OrcaRouter не добавляет наценку. Например, обработка запроса из 10 000 токенов и генерация 1 000 токенов будет стоить примерно $0.025 за вход и $0.01 за выход, в сумме $0.035. Стоимость линейно масштабируется с использованием токенов. Дополнительных комиссий за использование OrcaRouter в качестве API-шлюза нет. Следите за использованием, чтобы избежать неожиданных расходов. Сравните с более дешевыми моделями, если ваша задача не требует полных возможностей.
В настоящее время OrcaRouter не предлагает скидки за объем или кэширование токенов для этой модели. Оплата производится по мере использования на основе фактического количества использованных токенов по тарифу провайдера. Кэширование запросов или ответов не выполняется OrcaRouter; каждый запрос обрабатывается независимо. Если у вас очень высокая пропускная способность, свяжитесь с OrcaRouter для возможных индивидуальных договоренностей. Для оптимизации затрат рассмотрите возможность использования более коротких запросов, эффективного повторного использования контекста или группировки вызовов. Модель не поддерживает сниженные цены за кэшированные совпадения, поскольку механизм кэширования отсутствует.
При цене $2.50/$10 за миллион токенов эта предварительная версия оценивается аналогично стандартной GPT-4o, но может незначительно отличаться. Более дешёвые альтернативы включают openai/gpt-4o-mini (примерно $0.15/$0.60 за миллион) или gpt-3.5-turbo (примерно $0.50/$1.50). Для задач, которые могут мириться с более низким качеством, эти модели предлагают значительную экономию. Стоимость предварительной модели находится на верхнем конце каталога OrcaRouter. Если вы используете её исключительно для тестирования, вы можете понести умеренные затраты в зависимости от объёма запросов. Всегда оценивайте ожидаемое использование токенов и сравнивайте с выигрышем в качестве от использования более крупной модели.
Чтобы использовать эту модель, установите базовый URL вашего API-клиента на https://api.orcarouter.ai/v1 и укажите идентификатор модели как openai/gpt-4o-search-preview-2025-03-11. Вы должны использовать ключ API, выданный OrcaRouter. API полностью совместим с OpenAI, поэтому существующий код, написанный для конечной точки чат-завершений OpenAI, будет работать с минимальными изменениями. Пример вызова с использованием curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'.
Вы можете использовать все стандартные параметры завершения чата, поддерживаемые OpenAI: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop' и 'n'. Модель поддерживает контекстное окно в 128 000 токенов, поэтому 'max_tokens' можно установить до 16 384. 'temperature' контролирует случайность; значения варьируются от 0 до 2. 'stream' поддерживается для ответа в реальном времени. OrcaRouter не вводит дополнительных параметров. Убедитесь, что ваши запросы соответствуют лимитам токенов; входные данные, превышающие контекстное окно (включая ответ), будут обрезаны или вернут ошибку.
Миграция проста. Замените ваш базовый URL OpenAI (https://api.openai.com/v1) на базовый URL OrcaRouter (https://api.orcarouter.ai/v1). Измените ваш API-ключ на ключ OrcaRouter. Обновите поле модели на openai/gpt-4o-search-preview-2025-03-11. Никаких других изменений в коде не требуется. Если вы использовали другую модель OpenAI, вы можете продолжать использовать ту же структуру кода. OrcaRouter пропускает все стандартные параметры. После миграции убедитесь, что ответы согласованы. Обратите внимание, что выставление счетов будет обрабатываться OrcaRouter, и вам понадобится учетная запись там.
OrcaRouter не раскрывает публично конкретные лимиты на количество запросов для этой предварительной модели. Доступность зависит от инфраструктуры OpenAI и пропускной способности шлюза OrcaRouter. Для производственных приложений учитывайте статус предварительной версии модели и возможную нестабильность. OrcaRouter может вводить разумные ограничения использования для предотвращения злоупотреблений. Вы можете рассчитывать на обслуживание по принципу «best-effort», но никакого SLA не предоставляется. Если вам требуется гарантированная пропускная способность, обратитесь в OrcaRouter для получения выделенных вариантов. Модель также может быть удалена или заменена без уведомления, поэтому предусмотрите резервные модели.
Стандартная модель GPT-4o (openai/gpt-4o) является мультимодальной, стабильной версией, в то время как эта предварительная версия поддерживает только текст и предназначена для раннего тестирования. Предварительная версия может включать будущие функции, которых пока нет в стандартной версии, но также может быть менее надежной. Цены схожи. Стандартная модель имеет более широкую поддержку ввода (изображения, аудио). Если вам не нужны функции предварительной версии, стандартная GPT-4o — более безопасный выбор. Обе модели доступны на OrcaRouter с тем же интерфейсом API, что упрощает переключение.
Gpt-4o-mini — это более маленькая и дешевая модель, оптимизированная для простых задач. Она стоит примерно $0,15 за миллион входных токенов и $0,60 за миллион выходных (приблизительно). Эта предварительная модель примерно в 16 раз дороже по входу и в 16 раз дороже по выходу. Предварительная версия предлагает больший контекст (128K против 128K? На самом деле gpt-4o-mini тоже имеет 128K, но это может различаться. Мы знаем, что эта модель — 128K. У Gpt-4o-mini контекст также 128K согласно публичной информации, но мы не можем быть уверены. Скажем «сопоставимое окно контекста», но отметим разницу в цене.) Эта модель лучше подходит для сложных рассуждений, тогда как gpt-4o-mini достаточна для многих стандартных задач. Выбирайте исходя из потребностей в качестве и бюджета.
Модели Claude (например, Claude 3.5 Sonnet) предлагают большие контекстные окна и сильные рассуждения, но их API не является напрямую совместимым с OpenAI. OrcaRouter предоставляет единый интерфейс для нескольких провайдеров, но данная предварительная версия доступна исключительно через OpenAI. Модели Claude могут иметь разную ценовую политику и сильные стороны в таких областях, как безопасность и генерация длинных текстов. Для прямого сравнения вам потребуется протестировать на своих собственных сценариях использования. OrcaRouter позволяет переключаться между провайдерами, но эта предварительная модель доступна только через OpenAI. Сравнительные тесты не предоставляются.
Совместимо с OpenAI — оставьте свой SDK
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Ввод / 1M токенов | $2.50 |
| Вывод / 1M токенов | $10.00 |
| Валюта | USD |
Оценка по прайс-листу
Только оценка — фактическое число токенов зависит от токенизатора провайдера.
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11Открыть @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11