GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
ИнструментыJSON
от OpenAI · 2023-08-28

Эта модель предлагает в четыре раза большую длину контекста, чем gpt-3.5-turbo, что позволяет ей обрабатывать примерно 20 страниц текста в одном запросе при более высокой стоимости. Обучающие данные: до...

Эндпоинты:/v1/chat/completions
конт.16.4K токенов
Макс. вывод4.1K
Вводtext
Выводtext
p50 TTFT2.00 s
ВХОД$3.00/ 1M токенов
ВЫХОД$4.00/ 1M токенов
p50 TTFT2.00 s7 д
p95 TTFT2.92 s7 д
ТРАФИК14.6Kтокенов / 7 д

GPT-3.5 Turbo 16k — это версия модели OpenAI GPT-3.5 Turbo с расширенным контекстом, изначально выпущенная для поддержки задач, требующих обработки больших объёмов текста без разделения. Её окно…

Что такое GPT-3.5 Turbo 16k?

Для кого эта модель?

Каковы ключевые спецификации?

Как OrcaRouter предоставляет доступ?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Цены

Ввод / 1M токенов$3.00
Вывод / 1M токенов$4.00
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $33.00

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.002057

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
2.00 s
Скорость вывода
103 tok/s
p95 TTFT
2.92 s
Частота ошибок
0%

Публичные тесты

10.7
AA Coding
Лучше, чем 2% сравниваемых моделей
115 из 120
3.6
AA Intelligence
Лучше, чем 0% сравниваемых моделей
119 из 122
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Источник: artificialanalysis.ai

Сравнение

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Ввод $/млн$3.00$21.00$60.00$5.00
Вывод $/млн$4.00$168.00$270.00$30.00
Контекст16K400K1.1M
Качество2/1010/1010/1010/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от OpenAI

FAQ

Какова стоимость GPT-3.5 Turbo 16k на OrcaRouter?
Стоимость составляет $3.00 за 1M входных токенов и $4.00 за 1M выходных токенов, выставляется по точной ставке провайдера OpenAI без наценки. Никаких дополнительных комиссий платформы нет.
Какой размер контекстного окна?
Модель поддерживает контекстное окно из 16,385 токенов и максимальный вывод из 4,096 токенов. Она обрабатывает только текстовый ввод.
Каковы преимущества этой модели по сравнению с GPT-3.5 Turbo 4k?
Главное преимущество — это контекст в 16k, позволяющий обрабатывать более длинные документы или диалоги в одном запросе без разделения. Производительность в бенчмарках также немного лучше: 46.2 на MMLU‑Pro против около 43 на стандартном MMLU для 4k-варианта.
Как это соотносится с GPT-4?
GPT-3.5 Turbo 16k гораздо менее способен в рассуждениях, фактической точности и тонких задачах. GPT‑4 набирает >80 баллов на MMLU и лучше справляется со сложной логикой, но в 10–20 раз дороже и медленнее. Используйте GPT-3.5 Turbo 16k, когда требуется расширенный контекст, но не требуется продвинутое рассуждение.
Как OrcaRouter обрабатывает мои данные при использовании этой модели?
OrcaRouter действует как прокси: он перенаправляет ваш API-запрос к OpenAI и возвращает ответ. Он не хранит и не регистрирует содержимое запросов (prompt) за пределами временной обработки запроса. За подробной информацией об обработке данных обращайтесь к политике конфиденциальности OrcaRouter и условиям использования данных OpenAI.
Как вызвать эту модель через API, совместимый с OpenAI?
Укажите базовый URL как https://api.orcarouter.ai/v1 и используйте идентификатор модели "openai/gpt-3.5-turbo-16k". Все остальные параметры завершения чата (messages, temperature, max_tokens и т.д.) работают идентично API OpenAI.
Что если я превышу лимит в 16,384 токена?
OrcaRouter вернет ошибку, указывающую, что объединенные токены промпта и завершения превышают контекстное окно модели. Вам нужно сократить ввод, уменьшить max_tokens или разделить запрос на несколько вызовов.
Могу ли я использовать стриминг с этой моделью?
Да, установите параметр stream в значение true в вашем запросе. OrcaRouter будет передавать токены обратно в виде событий данных, следуя тому же формату, что и потоковый API OpenAI.
Есть ли какие-либо минимальные расходы или обязательства?
Нет. Вы платите только за использованные токены. Никакой абонентской платы, минимальных ежемесячных обязательств или оптовых скидок. Ценообразование строго по мере использования.

Встроить значок

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k в OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Карточка модели в виде данных

GET /api/public/models/openai/gpt-3.5-turbo-16kОткрыть
Машиночитаемо:/llms.txt/llms-full.txt