openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
StrumentiJSON
di openai

Modello di testo conveniente da OpenAI con punteggio MMLU-Pro di 46.2, accessibile tramite API OrcaRouter.

Output max4.1K
Inputtext
p50 TTFT3.64 s
INGRESSO$0.50/ 1M token
USCITA$1.50/ 1M token
p50 TTFT3.64 s7 g
p95 TTFT3.64 s7 g
TRAFFICO5.8Ktoken / 7 g

openai/gpt-3.5-turbo-0125 è un modello di generazione di testo sviluppato da OpenAI e disponibile tramite l'API di OrcaRouter. Fa parte della famiglia GPT-3.5-Turbo, ottimizzato per attività…

Cos'è openai/gpt-3.5-turbo-0125?

Chi dovrebbe usare questo modello?

Come fa OrcaRouter a fornire questo modello?

Quali sono le caratteristiche di input/output?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Prezzi

Input / 1M token$0.500
Output / 1M token$1.50
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $8.00

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000759

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
3.64 s
Velocità di output
Raccolta…
p95 TTFT
3.64 s
Tasso di errore
0%

Benchmark pubblici

10.7
AA Coding
Migliore del 2% dei modelli confrontati
n. 118 su 123
3.6
AA Intelligence
Migliore del 0% dei modelli confrontati
n. 122 su 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Fonte: artificialanalysis.ai

A confronto

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.50$21.00$60.00$5.00
Output $/M$1.50$168.00$270.00$30.00
Contesto400K1.1M
Qualità2/1010/1010/1010/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per utilizzare openai/gpt-3.5-turbo-0125 su OrcaRouter?
Il prezzo è esattamente la tariffa diretta di OpenAI senza alcun ricarico: $0.50 per 1 milione di token di input e $1.50 per 1 milione di token di output. Non ci sono costi aggiuntivi.
Qual è la dimensione della finestra di contesto?
Il modello supporta un contesto totale di 16,385 token (input + output), con un output limitato a 4096 token per generazione. Questa è un'informazione pubblica ampiamente nota per questa versione del modello.
Quali sono i principali punti di forza di questo modello?
Offre un buon equilibrio tra velocità, costo e qualità per le attività di testo. Ottiene 46.2 su MMLU-Pro e gestisce in modo affidabile il seguire le istruzioni, la chat e gli output strutturati.
Come si confronta con GPT-4?
GPT-4 lo supera nel ragionamento complesso, ma costa significativamente di più per token. Usa GPT-3.5-Turbo-0125 per applicazioni sensibili ai costi o ad alto volume dove non è richiesta una precisione quasi pari a GPT-4.
OrcaRouter registra o memorizza i miei dati?
OrcaRouter elabora le richieste verso l'API di OpenAI. Non registra né memorizza prompt o completamenti oltre quanto necessario per la fatturazione e la sicurezza operativa. Consulta l'informativa sulla privacy di OpenAI per la gestione dei loro dati.
Come faccio a chiamare questo modello usando un'API compatibile con OpenAI?
Imposta l'URL di base su https://api.orcarouter.ai/v1, il modello su 'openai/gpt-3.5-turbo-0125', e usa la tua chiave API OrcaRouter nell'intestazione Authorization. Il formato standard delle chat completions funziona.
Posso ricevere le risposte in streaming?
Sì. Imposta il parametro 'stream' su true nella tua richiesta. Le risposte verranno inviate come eventi inviati dal server con delta di token, corrispondenti al formato di streaming di OpenAI.
Qual è la lunghezza massima dell'output?
Il modello può generare fino a 4096 token in una singola risposta. Usa il parametro 'max_tokens' per controllare questo, ma non può superare 4096.
Questo modello è adatto per attività multilingue?
Funziona in molte lingue ma dà il meglio di sé in inglese. L'accuratezza può diminuire per lingue a basse risorse o espressioni idiomatiche complesse.

Incorpora questo badge

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 su OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Scheda del modello come dati

GET /api/public/models/openai/gpt-3.5-turbo-0125Apri
Leggibile dalle macchine:/llms.txt/llms-full.txt