openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
NarzędziaJSON
przez openai

Opłacalny model tekstowy od OpenAI z wynikiem 46.2 w MMLU-Pro, dostępny przez API OrcaRouter.

Punkty końcowe:/v1/chat/completions
Maks. wyjście4.1K
Wejścietext
p50 TTFT3.64 s
WEJŚCIE$0.50/ 1M tokenów
WYJŚCIE$1.50/ 1M tokenów
p50 TTFT3.64 s7 d
p95 TTFT3.64 s7 d
RUCH5.8Ktokenów / 7 d

openai/gpt-3.5-turbo-0125 to model generowania tekstu opracowany przez OpenAI i dostępny za pośrednictwem API OrcaRouter. Jest częścią rodziny GPT-3.5-Turbo, zoptymalizowanej pod kątem zadań…

Co to jest openai/gpt-3.5-turbo-0125?

Kto powinien używać tego modelu?

Jak OrcaRouter dostarcza ten model?

Jakie są charakterystyki wejścia/wyjścia?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Cennik

Wejście / 1M tokenów$0.500
Wyjście / 1M tokenów$1.50
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $8.00

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000759

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
3.64 s
Prędkość wyjścia
Zbieranie…
p95 TTFT
3.64 s
Wskaźnik błędów
0%

Publiczne benchmarki

10.7
AA Coding
Lepszy niż 2% porównywanych modeli
118 z 123
3.6
AA Intelligence
Lepszy niż 0% porównywanych modeli
122 z 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Źródło: artificialanalysis.ai

Porównanie

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Wejście $/M$0.50$21.00$60.00$5.00
Wyjście $/M$1.50$168.00$270.00$30.00
Kontekst400K1.1M
Jakość2/1010/1010/1010/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt użycia openai/gpt-3.5-turbo-0125 na OrcaRouter?
Ceny są dokładnie stawką bezpośrednią OpenAI z zerową marżą: 0,50 USD za 1 milion tokenów wejściowych i 1,50 USD za 1 milion tokenów wyjściowych. Nie ma dodatkowych opłat.
Jaki jest rozmiar okna kontekstu?
Model obsługuje całkowity kontekst 16,385 tokenów (wejście + wyjście), z wyjściem ograniczonym do 4096 tokenów na generację. Jest to powszechnie znana publiczna informacja dotycząca tej wersji modelu.
Jakie są główne mocne strony tego modelu?
Oferuje silną równowagę między prędkością, kosztem a jakością w zadaniach tekstowych. Osiąga wynik 46.2 w MMLU-Pro i niezawodnie radzi sobie z podążaniem za instrukcjami, czatem oraz strukturalnymi wyjściami.
Jak wypada w porównaniu z GPT-4?
GPT-4 przewyższa go w złożonym rozumowaniu, ale kosztuje znacznie więcej za token. Używaj GPT-3.5-Turbo-0125 w aplikacjach wrażliwych na koszty lub o dużej objętości, gdzie dokładność zbliżona do GPT-4 nie jest wymagana.
Czy OrcaRouter rejestruje lub przechowuje moje dane?
OrcaRouter przetwarza żądania do API OpenAI. Nie rejestruje ani nie przechowuje promptów ani odpowiedzi poza tym, co jest niezbędne do rozliczeń i bezpieczeństwa operacyjnego. Zapoznaj się z polityką prywatności OpenAI dotyczącą ich sposobu przetwarzania danych.
Jak wywołać ten model za pomocą API zgodnego z OpenAI?
Ustaw podstawowy URL na https://api.orcarouter.ai/v1, model na 'openai/gpt-3.5-turbo-0125', i użyj swojego klucza API OrcaRouter w nagłówku Authorization. Standardowy format odpowiedzi czatu jest obsługiwany.
Czy mogę strumieniować odpowiedzi?
Tak. Ustaw parametr 'stream' na true w swoim żądaniu. Odpowiedzi będą wysyłane jako zdarzenia przesyłane przez serwer z różnicami tokenów, zgodne z formatem strumieniowania OpenAI.
Jaka jest maksymalna długość wyjścia?
Model może wygenerować do 4096 tokenów w jednej odpowiedzi. Użyj parametru 'max_tokens', aby to kontrolować, ale nie może on przekroczyć 4096.
Czy ten model nadaje się do zadań wielojęzycznych?
Działa w wielu językach, ale najlepszą wydajność osiąga w języku angielskim. Dokładność może spaść w przypadku języków o niskich zasobach lub złożonych wyrażeń idiomatycznych.

Osadź tę odznakę

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 w OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Karta modelu jako dane

GET /api/public/models/openai/gpt-3.5-turbo-0125Otwórz
Odczyt maszynowy:/llms.txt/llms-full.txt