openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
ToolsJSON
von openai

Kostengünstiges Textmodell von OpenAI mit einer MMLU-Pro-Bewertung von 46.2, abgerufen über die OrcaRouter-API.

Max. Ausgabe4.1K
Eingabetext
p50 TTFT3.64 s
EINGABE$0.50/ 1M Tokens
AUSGABE$1.50/ 1M Tokens
p50 TTFT3.64 s7 T
p95 TTFT3.64 s7 T
DATENVERKEHR5.8KTokens / 7 T

openai/gpt-3.5-turbo-0125 ist ein Textgenerierungsmodell, das von OpenAI entwickelt wurde und über die API von OrcaRouter verfügbar ist. Es gehört zur GPT-3.5-Turbo-Familie, optimiert für…

Was ist openai/gpt-3.5-turbo-0125?

Wer sollte dieses Modell verwenden?

Wie stellt OrcaRouter dieses Modell bereit?

Was sind die Eingabe-/Ausgabeeigenschaften?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Preise

Eingabe / 1M Tokens$0.500
Ausgabe / 1M Tokens$1.50
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $8.00

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000763

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
3.64 s
Ausgabegeschwindigkeit
Wird erfasst…
p95 TTFT
3.64 s
Fehlerquote
0%

Öffentliche Benchmarks

10.7
AA Coding
Besser als 2 % der verglichenen Modelle
Nr. 118 von 123
3.6
AA Intelligence
Besser als 0 % der verglichenen Modelle
Nr. 122 von 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Quelle: artificialanalysis.ai

Im Vergleich

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Eingabe $/M$0.50$21.00$60.00$5.00
Ausgabe $/M$1.50$168.00$270.00$30.00
Kontext400K1.1M
Qualität2/1010/1010/1010/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet die Nutzung von openai/gpt-3.5-turbo-0125 auf OrcaRouter?
Die Preisgestaltung entspricht exakt dem direkten Satz von OpenAI ohne Aufschlag: 0,50 $ pro 1 Million Eingabe-Token und 1,50 $ pro 1 Million Ausgabe-Token. Es fallen keine zusätzlichen Gebühren an.
Wie groß ist das Kontextfenster?
Das Modell unterstützt einen Gesamtkontext von 16.385 Token (Eingabe + Ausgabe), wobei die Ausgabe pro Generierung auf 4096 Token begrenzt ist. Dies ist eine allgemein bekannte öffentliche Information für diese Modellversion.
Was sind die Hauptstärken dieses Modells?
Es bietet eine ausgewogene Kombination aus Geschwindigkeit, Kosten und Qualität für Textaufgaben. Es erreicht 46,2 im MMLU-Pro und bewältigt zuverlässig das Befolgen von Anweisungen, Chat sowie strukturierte Ausgaben.
Wie schneidet es im Vergleich zu GPT-4 ab?
GPT-4 übertrifft es bei komplexem Denken, kostet aber deutlich mehr pro Token. Verwenden Sie GPT-3.5-Turbo-0125 für kostenempfindliche oder Anwendungen mit hohem Volumen, bei denen keine nahezu GPT-4-Genauigkeit erforderlich ist.
Protokolliert oder speichert OrcaRouter meine Daten?
OrcaRouter verarbeitet Anfragen an die API von OpenAI. Es protokolliert oder speichert keine Prompts oder Vervollständigungen über das hinaus, was für Abrechnung und Betriebssicherheit notwendig ist. Lesen Sie die Datenschutzrichtlinie von OpenAI für deren Datenverarbeitung.
Wie rufe ich dieses Modell mit einer OpenAI-kompatiblen API auf?
Setzen Sie die Basis-URL auf https://api.orcarouter.ai/v1, das Modell auf 'openai/gpt-3.5-turbo-0125' und verwenden Sie Ihren OrcaRouter-API-Schlüssel im Authorization-Header. Das Standard-Chat-Completions-Format funktioniert.
Kann ich Antworten streamen?
Ja. Setzen Sie den Parameter 'stream' in Ihrer Anfrage auf true. Antworten werden als Server-Sent Events mit Token-Deltas gesendet, die dem OpenAI-Streaming-Format entsprechen.
Was ist die maximale Ausgabelänge?
Das Modell kann in einer einzigen Antwort bis zu 4096 Tokens generieren. Verwenden Sie den Parameter 'max_tokens', um dies zu steuern, er darf jedoch 4096 nicht überschreiten.
Ist dieses Modell für mehrsprachige Aufgaben geeignet?
Es funktioniert in vielen Sprachen, aber am besten in Englisch. Die Genauigkeit kann bei Sprachen mit geringen Ressourcen oder komplexen idiomatischen Ausdrücken sinken.

Dieses Abzeichen einbetten

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 auf OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Modellkarte als Daten

GET /api/public/models/openai/gpt-3.5-turbo-0125Öffnen
Maschinenlesbar:/llms.txt/llms-full.txt