openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
ToolsJSON
door openai

Kosteneffectief tekstmodel van OpenAI met een MMLU-Pro-score van 46.2, toegankelijk via de OrcaRouter API.

Max. uitvoer4.1K
Invoertext
p50 TTFT3.64 s
INPUT$0.50/ 1M tokens
OUTPUT$1.50/ 1M tokens
p50 TTFT3.64 s7d
p95 TTFT3.64 s7d
VERKEER5.8Ktokens / 7d

openai/gpt-3.5-turbo-0125 is een tekstgeneratiemodel ontwikkeld door OpenAI en beschikbaar via de API van OrcaRouter. Het maakt deel uit van de GPT-3.5-Turbo-familie, geoptimaliseerd voor…

Wat is openai/gpt-3.5-turbo-0125?

Wie zou dit model moeten gebruiken?

Hoe levert OrcaRouter dit model?

Wat zijn de invoer-/uitvoerkenmerken?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Prijzen

Invoer / 1M tokens$0.500
Uitvoer / 1M tokens$1.50
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $8.00

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000760

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
3.64 s
Outputsnelheid
Verzamelen…
p95 TTFT
3.64 s
Foutpercentage
0%

Openbare benchmarks

10.7
AA Coding
Beter dan 2% van de vergeleken modellen
#118 van 123
3.6
AA Intelligence
Beter dan 0% van de vergeleken modellen
#122 van 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Bron: artificialanalysis.ai

Vergelijking

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Invoer $/M$0.50$21.00$60.00$5.00
Uitvoer $/M$1.50$168.00$270.00$30.00
Context400K1.1M
Kwaliteit2/1010/1010/1010/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat zijn de kosten om openai/gpt-3.5-turbo-0125 op OrcaRouter te gebruiken?
De prijzen zijn exact de directe tarieven van OpenAI zonder opslag: $0.50 per 1 miljoen invoertokens en $1.50 per 1 miljoen uitvoertokens. Er zijn geen extra kosten.
Wat is de grootte van het contextvenster?
Het model ondersteunt een totale context van 16.385 tokens (input + output), met een maximum van 4096 tokens per generatie voor de output. Dit is algemeen bekende publieke informatie voor deze modelversie.
Wat zijn de belangrijkste sterke punten van dit model?
Het biedt een sterke balans tussen snelheid, kosten en kwaliteit voor teksttaken. Het scoort 46.2 op MMLU-Pro en gaat betrouwbaar om met het opvolgen van instructies, chat en gestructureerde uitvoer.
Hoe verhoudt het zich tot GPT-4?
GPT-4 presteert er beter op complex redeneren, maar kost aanzienlijk meer per token. Gebruik GPT-3.5-Turbo-0125 voor kostenbewuste of toepassingen met hoog volume waar bijna-GPT-4-nauwkeurigheid niet vereist is.
Logt of bewaart OrcaRouter mijn gegevens?
OrcaRouter verwerkt verzoeken naar de API van OpenAI. Het logt of bewaart geen prompts of completions voorbij wat nodig is voor facturering en operationele beveiliging. Bekijk het privacybeleid van OpenAI voor hun gegevensverwerking.
Hoe roep ik dit model aan met een OpenAI-compatibele API?
Stel de basis-URL in op https://api.orcarouter.ai/v1, het model op 'openai/gpt-3.5-turbo-0125', en gebruik uw OrcaRouter API-sleutel in de Authorization-header. Het standaard chat completions-formaat werkt.
Kan ik antwoorden streamen?
Ja. Stel de 'stream'-parameter in op true in uw verzoek. Reacties worden verzonden als server-sent events met token-delta's, overeenkomend met het OpenAI-streamingformaat.
Wat is de maximale outputlengte?
Het model kan maximaal 4096 tokens genereren in één enkele reactie. Gebruik de parameter 'max_tokens' om dit te regelen, maar deze mag niet hoger zijn dan 4096.
Is dit model geschikt voor meertalige taken?
Het werkt in veel talen, maar presteert het beste in het Engels. De nauwkeurigheid kan afnemen voor talen met weinig bronmateriaal of complexe idiomatische uitdrukkingen.

Sluit deze badge in

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 op OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Modelkaart als data

GET /api/public/models/openai/gpt-3.5-turbo-0125Openen
Machineleesbaar:/llms.txt/llms-full.txt