GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
NarzędziaJSON
przez OpenAI · 2023-08-28

Model ten oferuje czterokrotnie większą długość kontekstu niż gpt-3.5-turbo, co pozwala mu obsłużyć około 20 stron tekstu w jednym żądaniu, przy wyższym koszcie. Dane treningowe: do...

Punkty końcowe:/v1/chat/completions
kont.16.4K tokenów
Maks. wyjście4.1K
Wejścietext
Wyjścietext
p50 TTFT2.00 s
WEJŚCIE$3.00/ 1M tokenów
WYJŚCIE$4.00/ 1M tokenów
p50 TTFT2.00 s7 d
p95 TTFT3.63 s7 d
RUCH16.8Ktokenów / 7 d

GPT-3.5 Turbo 16k to rozszerzona wersja modelu GPT-3.5 Turbo od OpenAI, pierwotnie wydana do obsługi zadań wymagających przetwarzania większych ilości tekstu bez dzielenia. Jego pojemność kontekstu…

Czym jest GPT-3.5 Turbo 16k?

Dla kogo jest ten model?

Jakie są kluczowe specyfikacje?

Jak OrcaRouter zapewnia dostęp?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Cennik

Wejście / 1M tokenów$3.00
Wyjście / 1M tokenów$4.00
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $33.00

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.002057

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
2.00 s
Prędkość wyjścia
238 tok/s
p95 TTFT
3.63 s
Wskaźnik błędów
0%

Publiczne benchmarki

10.7
AA Coding
Lepszy niż 2% porównywanych modeli
118 z 123
3.6
AA Intelligence
Lepszy niż 0% porównywanych modeli
122 z 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Źródło: artificialanalysis.ai

Porównanie

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Wejście $/M$3.00$21.00$60.00$5.00
Wyjście $/M$4.00$168.00$270.00$30.00
Kontekst16K400K1.1M
Jakość2/1010/1010/1010/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt GPT-3.5 Turbo 16k w OrcaRouter?
Koszt wynosi $3.00 za 1M tokenów wejściowych i $4.00 za 1M tokenów wyjściowych, rozliczany według dokładnej stawki dostawcy OpenAI bez marży. Nie ma żadnych dodatkowych opłat platformowych.
Jaki jest rozmiar okna kontekstu?
Model obsługuje okno kontekstu o wielkości 16 385 tokenów i maksymalne wyjście 4 096 tokenów. Obsługuje tylko wejście tekstowe.
Jakie są mocne strony tego modelu w porównaniu do GPT-3.5 Turbo 4k?
Główną zaletą jest kontekst 16k, który pozwala na przetwarzanie dłuższych dokumentów lub rozmów w jednym żądaniu bez dzielenia. Wydajność w testach porównawczych jest również nieco lepsza: 46.2 w MMLU‑Pro wobec około 43 w standardowym MMLU dla wariantu 4k.
Jak wypada w porównaniu z GPT-4?
GPT-3.5 Turbo 16k jest znacznie mniej wydajny w zakresie rozumowania, dokładności faktograficznej i zadań wymagających niuansów. GPT-4 osiąga >80 punktów w MMLU i lepiej radzi sobie z złożoną logiką, ale jest 10-20 razy droższy i wolniejszy. Używaj GPT-3.5 Turbo 16k, gdy potrzebny jest rozszerzony kontekst, ale zaawansowane rozumowanie nie jest wymagane.
Jak OrcaRouter zarządza moimi danymi, gdy korzystam z tego modelu?
OrcaRouter działa jako pośrednik: przekazuje Twoje zapytanie API do OpenAI i zwraca odpowiedź. Nie przechowuje ani nie rejestruje treści promptów poza tymczasowym przetwarzaniem żądań. Aby uzyskać szczegółowe informacje na temat przetwarzania danych, zapoznaj się z polityką prywatności OrcaRouter i warunkami korzystania z danych przez OpenAI.
Jak wywołać ten model za pomocą API zgodnego z OpenAI?
Ustaw swój podstawowy URL na https://api.orcarouter.ai/v1 i użyj identyfikatora modelu "openai/gpt-3.5-turbo-16k". Wszystkie inne parametry uzupełniania czatu (messages, temperature, max_tokens, itp.) działają identycznie jak w API OpenAI.
Co jeśli przekroczę limit 16,384 tokenów?
OrcaRouter zwróci błąd wskazujący, że łączna liczba tokenów promptu i uzupełnienia przekracza okno kontekstu modelu. Należy skrócić dane wejściowe, zmniejszyć max_tokens lub podzielić żądanie na wiele wywołań.
Czy mogę używać streamingu z tym modelem?
Tak, ustaw parametr stream na true w swoim żądaniu. OrcaRouter będzie przesyłał tokeny z powrotem jako zdarzenia danych, zgodnie z tym samym formatem, co API strumieniowe OpenAI.
Czy jest jakiś minimalny wydatek lub zobowiązanie?
Nie. Płacisz tylko za wykorzystane tokeny. Nie ma opłat abonamentowych, minimalnych miesięcznych zobowiązań ani rabatów ilościowych. Cennik jest ściśle oparty na modelu pay‑as‑you‑go.

Osadź tę odznakę

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k w OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Karta modelu jako dane

GET /api/public/models/openai/gpt-3.5-turbo-16kOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt