Флагманская модель OpenAI с контекстом в 400 тыс. токенов, мультимодальным вводом и выводом в 272 тыс. токенов, доступная через OrcaRouter по тарифу провайдера.
Эта модель представляет собой конкретный снимок OpenAI GPT‑5 Pro, оптимизированный для сложных рассуждений и задач с длинным контекстом. Она принимает изображения, текст и файлы, обрабатывает до 400…
Модель принимает три типа входных данных: текст, изображения и файлы. Текст может быть стандартными строками UTF‑8. Изображения могут предоставляться в виде URL-адресов или данных, закодированных в base64, и модель может анализировать визуальный контент, такой как фотографии, схемы и скриншоты. Входные файлы охватывают множество форматов (например, PDF, Word, Excel, обычный текст), что позволяет модели читать и рассуждать над структурированными или неструктурированными документами. Все модальности могут быть объединены в одном запросе, что позволяет выполнять задачи, такие как извлечение информации из фотографии диаграммы и её сравнение с текстовым отчётом.
Большое контекстное окно идеально подходит для задач, требующих сохранения согласованности на очень длинных последовательностях. Примеры включают анализ целой исследовательской статьи или юридического документа за один проход, многошаговые рассуждения на основе длинной истории диалога или обработку полной кодовой базы для предложений по рефакторингу. Оно также поддерживает стратегии инженерии промптов, такие как использование длинного набора инструкций или нескольких примеров без усечения. Для задач, которые естественным образом укладываются в более короткие контексты, более мелкие и дешёвые модели могут быть более экономически эффективными.
Хотя GPT‑5 Pro обладает наивысшей производительностью, его стоимость ($15/$120 за миллион токенов) значительно выше, чем у моделей вроде GPT‑4o mini или альтернатив с открытым исходным кодом. Если ваша задача укладывается в 8k–32k токенов и не требует мультимодального ввода, модель меньшего размера может дать приемлемые результаты за небольшую часть стоимости. Кроме того, если длина вывода мала, затраты на токен становятся доминирующими. Оцените, действительно ли вам нужны контекст в 400k и вывод в 272k; в противном случае рассмотрите более дешевые варианты на OrcaRouter.
Входные файлы обрабатываются в соответствии с конвейером обработки файлов OpenAI. Модель может читать текст из поддерживаемых форматов файлов и интерпретировать встроенные изображения или таблицы. Для очень больших файлов количество токенов извлеченного содержимого учитывается в контекстном окне. Рекомендуется предварительно обрабатывать файлы, чтобы извлекать только соответствующие разделы, если использование токенов вызывает беспокойство. API OrcaRouter принимает файлы через ту же структуру параметров, что и API OpenAI, обычно через URL файла или кодировку base64.
В данной спецификации не указаны конкретные бенчмарки для этого снимка. Как флагманская модель OpenAI, ожидается, что она достигнет передовых результатов по стандартным тестам NLP, логики и мультимодальным задачам по сравнению с более ранними моделями GPT. Пользователям следует оценивать её на своих репрезентативных задачах, чтобы подтвердить пригодность. Большой контекстный окно не ухудшает производительность на коротких входах; модель сохраняет свою силу рассуждений независимо от длины контекста.
Задержка обычно выше, чем у меньших моделей, из-за большого контекста и выходной ёмкости. Время до первого токена (Time‑to‑first‑token) и общая скорость генерации зависят от длины промпта, длины вывода и текущей нагрузки сервера OpenAI. Для задач, требующих только коротких ответов, более быстрые модели, такие как GPT‑4o mini, могут быть более отзывчивыми. OrcaRouter не вносит существенной задержки сверх времени ответа провайдера. Конкретные значения задержки для этого снимка недоступны.
Его сильные стороны включают глубокое многошаговое рассуждение, обработку очень длинных контекстов с минимальной потерей информации, мультимодальное понимание (объединение текста, изображений, файлов) и генерацию структурированных, связных выходных данных объемом до 272k токенов. Он превосходно справляется с задачами, которые включают сложные инструкции, большие наборы данных или требуют синтеза информации из нескольких источников в рамках одного запроса. Например, он может проанализировать 300-страничный документ и подготовить исчерпывающее резюме с цитатами.
Несмотря на свою мощность, модель не является непогрешимой. Она все еще может выдавать галлюцинации, особенно по малоизвестным темам или когда контекст содержит противоречивую информацию. Большое окно контекста не устраняет ошибки внимания; длинные входные данные иногда могут заставить модель упускать мелкие детали. Кроме того, высокий лимит выходных токенов может приводить к очень длинным, но не обязательно полностью точным ответам. Пользователям следует внедрять верификацию для ответов с высокой степенью ответственности. Ценообразование является ограничением для приложений, чувствительных к бюджету.
Входные токены тарифицируются по $15.00 за 1 миллион токенов, а выходные — по $120.00 за 1 миллион токенов. Это точные расценки, установленные OpenAI; OrcaRouter не добавляет никакой наценки. Например, промпт, потребляющий 50,000 входных токенов и генерирующий 10,000 выходных токенов, будет стоить $0.75 за входные и $1.20 за выходные токены, итого $1.95. Никаких дополнительных комиссий, кроме потребления за токен, не применяется.
Соотношение 8× между ценой ввода и вывода отражает более высокую вычислительную стоимость генерации токенов. Создание длинных и связных ответов требует большего объема обработки, чем кодирование ввода. Высокая цена вывода также стимулирует эффективное составление запросов: для задач, которые могут быть выполнены с помощью коротких ответов, может быть более экономичным использовать модель с более низким уровнем вывода. Благодаря политике нулевой наценки OrcaRouter вы платите ровно ту стоимость, которую провайдер назначает за каждый токен.
OrcaRouter не предлагает собственного кэширования токенов или программ скидок для этой модели; оплата производится за токен по тарифу провайдера. Некоторые провайдеры могут предлагать более низкие ставки для пакетной обработки или зарезервированной емкости, но этот снимок доступен только как однократный API-запрос по требованию. Если у вас очень высокий объем, обратитесь в поддержку OrcaRouter, чтобы обсудить возможные индивидуальные договоренности, хотя конкретные скидки не рекламируются.
Оцените, рассчитав количество токенов в вашем среднем запросе и ожидаемую длину ответа. Используйте токенизатор OpenAI или эндпоинт подсчёта токенов OrcaRouter API. Например, запрос на 100,000 токенов с ответом на 50,000 токенов стоит $1.50 за ввод + $6.00 за вывод = $7.50 за вызов. Если ваше приложение выполняет тысячи таких вызовов, затраты могут быстро возрасти. Рассмотрите возможность использования меньших моделей для простых задач и оставьте GPT‑5 Pro для самых требовательных.
Используйте базовый URL OrcaRouter https://api.orcarouter.ai/v1 с идентификатором модели "openai/gpt-5-pro-2025-10-06". API полностью совместим с конечной точкой chat completions от OpenAI. Типичный запрос включает ваш API-ключ, параметр модели, массив messages и опциональные параметры, такие как max_tokens, temperature и top_p. Для мультимодальных входных данных включите поля image_url или file_url в содержимое сообщения. Ответы возвращаются в том же формате, что и API OpenAI.
Параметр max_tokens может быть установлен до 272 000 (в зависимости от лимита контекстного окна). Диапазон temperature — 0–2, при этом меньшие значения дают более детерминированные результаты. top_p (0–1) управляет семплированием по ядру. frequency_penalty и presence_penalty находятся в диапазоне от –2 до 2. Для мультимодальных входных данных необходимо указать тип содержимого (text, image_url, file_url). Параметр stop принимает до четырёх последовательностей. Также поддерживаются все остальные параметры, которые поддерживаются в чат-завершениях OpenAI.
Измените базовый URL с `https://api.openai.com/v1` на `https://api.orcarouter.ai/v1` и замените API-ключ на ваш ключ OrcaRouter. Используйте имя модели `"openai/gpt-5-pro-2025-10-06"` точно. Все остальные структуры запросов и ответов остаются без изменений. Никакого переобучения или изменений кода, кроме эндпоинта и ключа, не требуется. OrcaRouter поддерживает те же режимы потоковой и не потоковой передачи. Сначала протестируйте с низкостоимостным запросом, чтобы проверить биллинг и функциональность.
Аутентификация использует ключ API, отправляемый в заголовке Authorization (токен Bearer). Ограничения скорости OrcaRouter могут отличаться от прямых ограничений OpenAI; проверьте панель управления учетной записью OrcaRouter для получения подробной информации. Для интенсивного использования рассмотрите возможность пакетной отправки запросов или обратитесь в поддержку для увеличения лимитов. Сама модель наследует ограничения скорости OpenAI на бэкенде. Убедитесь, что ваше приложение обрабатывает ошибки превышения скорости (HTTP 429) с логикой повторных попыток.
GPT‑4 Turbo (обычно окно контекста в 128k и максимальный вывод в 16k) дешевле и быстрее для стандартных задач. GPT‑5 Pro предлагает более чем в три раза больший контекст и длину вывода в 17 раз больше, позволяя выполнять задачи, которые GPT‑4 Turbo не может обработать за один вызов. Однако более низкая стоимость GPT‑4 Turbo ($10/$30 за 1 млн токенов) делает его более экономичным для коротких запросов. Выбирайте GPT‑5 Pro, когда вам нужны расширенные возможности контекста или вывода; в противном случае GPT‑4 Turbo часто достаточно.
GPT‑4o поддерживает мультимодальные входные данные (текст, изображения) с контекстом 128k и выводом 16k. В целом он быстрее и дешевле ($5/$15 за 1M токенов), чем GPT‑5 Pro. Более крупный контекст и объём вывода GPT‑5 Pro делают его предпочтительным для глубокого анализа очень длинных документов или создания длинного контента. Для типичных мультимодальных задач, укладывающихся в ограничения GPT‑4o, GPT‑4o предлагает лучшее соотношение цены и производительности. Обе модели доступны через OrcaRouter.
Если ваш вариант использования не требует экосистемы OpenAI или специфической производительности GPT‑5 Pro, модели от Anthropic (Claude 3.5 Sonnet) или Google (Gemini 1.5 Pro) могут предложить сопоставимые возможности по другим ценам или с другой политикой обработки данных. Например, Claude 3.5 Sonnet имеет контекст в 200 тысяч токенов и более низкую стоимость вывода. Оценку проводите на основе задержки, цены за токен, местонахождения данных и конкретных тестов, релевантных вашей задаче. OrcaRouter предоставляет доступ к нескольким провайдерам для удобного сравнения.
Совместимо с OpenAI — оставьте свой SDK
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-5-pro-2025-10-06",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatseedstreamstructured_outputstool_choicetools| Ввод / 1M токенов | $15.00 |
|---|---|
| Вывод / 1M токенов | $120.00 |
| Валюта | USD |
Оценка по прайс-листу
Только оценка — фактическое число токенов зависит от токенизатора провайдера.
О чём говорят разработчики на этой неделе
GET /api/public/models/openai/gpt-5-pro-2025-10-06Открыть @misc{orcarouter_gpt_5_pro_2025_10_06,
title = {openai/gpt-5-pro-2025-10-06 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-5-pro-2025-10-06}
}openai. (n.d.). openai/gpt-5-pro-2025-10-06 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-5-pro-2025-10-06