openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
OutilsJSON
par openai

Modèle de texte économique d'OpenAI avec un score MMLU-Pro de 46,2, accessible via l'API OrcaRouter.

Points de terminaison:/v1/chat/completions
Sortie max4.1K
Entréetext
p50 TTFT3.64 s
ENTRÉE$0.50/ 1M tokens
SORTIE$1.50/ 1M tokens
p50 TTFT3.64 s7 j
TTFT p953.64 s7 j
TRAFIC5.8Ktokens / 7 j

openai/gpt-3.5-turbo-0125 est un modèle de génération de texte développé par OpenAI et disponible via l'API d'OrcaRouter. Il fait partie de la famille GPT-3.5-Turbo, optimisé pour les tâches…

Qu'est-ce que openai/gpt-3.5-turbo-0125 ?

Qui devrait utiliser ce modèle ?

Comment OrcaRouter livre-t-il ce modèle ?

Quelles sont les caractéristiques d'entrée/sortie ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Tarifs

Entrée / 1M tokens$0.500
Sortie / 1M tokens$1.50
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $8.00

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000759

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
3.64 s
Vitesse de sortie
Collecte…
TTFT p95
3.64 s
Taux d'erreur
0%

Benchmarks publics

10.7
AA Coding
Meilleur que 2 % des modèles comparés
n°118 sur 123
3.6
AA Intelligence
Meilleur que 0 % des modèles comparés
n°122 sur 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Source: artificialanalysis.ai

Comparatif

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$0.50$21.00$60.00$5.00
Sortie $/M$1.50$168.00$270.00$30.00
Contexte400K1.1M
Qualité2/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût pour utiliser openai/gpt-3.5-turbo-0125 sur OrcaRouter ?
Le prix est exactement le tarif direct d'OpenAI sans aucune majoration : 0,50 $ pour 1 million de jetons d'entrée et 1,50 $ pour 1 million de jetons de sortie. Il n'y a pas de frais supplémentaires.
Quelle est la taille de la fenêtre de contexte ?
Le modèle prend en charge un contexte total de 16 385 tokens (entrée + sortie), avec une sortie plafonnée à 4096 tokens par génération. Il s'agit d'une information publique largement connue pour cette version du modèle.
Quels sont les principaux atouts de ce modèle ?
Il offre un bon équilibre entre vitesse, coût et qualité pour les tâches textuelles. Il obtient un score de 46,2 sur MMLU-Pro et gère de manière fiable le suivi des instructions, le chat et les sorties structurées.
Comment se compare-t-il à GPT-4 ?
GPT-4 le surpasse en raisonnement complexe mais coûte beaucoup plus par token. Utilisez GPT-3.5-Turbo-0125 pour les applications sensibles au coût ou à volume élevé où une précision proche de celle de GPT-4 n'est pas requise.
OrcaRouter enregistre-t-il ou stocke-t-il mes données ?
OrcaRouter traite les requêtes vers l'API d'OpenAI. Il ne journalise ni ne stocke les prompts ou les complétions au-delà de ce qui est nécessaire pour la facturation et la sécurité opérationnelle. Consultez la politique de confidentialité d'OpenAI concernant le traitement de leurs données.
Comment appeler ce modèle en utilisant une API compatible OpenAI ?
Définissez l'URL de base sur https://api.orcarouter.ai/v1, le modèle sur 'openai/gpt-3.5-turbo-0125', et utilisez votre clé API OrcaRouter dans l'en-tête Authorization. Le format standard de chat completions fonctionne.
Puis-je diffuser les réponses en continu ?
Oui. Définissez le paramètre 'stream' sur true dans votre requête. Les réponses seront envoyées sous forme d'événements envoyés par le serveur avec des deltas de jetons, en correspondance avec le format de streaming d'OpenAI.
Quelle est la longueur maximale de sortie ?
Le modèle peut générer jusqu'à 4096 tokens en une seule réponse. Utilisez le paramètre 'max_tokens' pour contrôler cela, mais il ne peut pas dépasser 4096.
Ce modèle est-il adapté aux tâches multilingues ?
Il fonctionne dans de nombreuses langues mais fonctionne le mieux en anglais. La précision peut diminuer pour les langues peu dotées en ressources ou les expressions idiomatiques complexes.

Intégrer ce badge

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 sur OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Fiche du modèle en données

GET /api/public/models/openai/gpt-3.5-turbo-0125Ouvrir
Lisible par machine:/llms.txt/llms-full.txt