GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
OutilsJSON
par OpenAI · 2023-08-28

Ce modèle offre quatre fois la longueur de contexte de gpt-3.5-turbo, ce qui lui permet de supporter environ 20 pages de texte en une seule requête, à un coût plus élevé. Données d'entraînement : jusqu'à...

Points de terminaison:/v1/chat/completions
ctx16.4K tokens
Sortie max4.1K
Entréetext
Sortietext
p50 TTFT2.00 s
ENTRÉE$3.00/ 1M tokens
SORTIE$4.00/ 1M tokens
p50 TTFT2.00 s7 j
TTFT p953.63 s7 j
TRAFIC16.8Ktokens / 7 j

GPT-3.5 Turbo 16k est une version à contexte étendu du modèle GPT-3.5 Turbo d’OpenAI, initialement publiée pour prendre en charge les tâches nécessitant le traitement de grandes quantités de texte…

Qu'est-ce que GPT-3.5 Turbo 16k ?

Pour qui est ce modèle ?

Quelles sont les spécifications clés ?

Comment OrcaRouter fournit-il l'accès ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Tarifs

Entrée / 1M tokens$3.00
Sortie / 1M tokens$4.00
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $33.00

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.002051

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
2.00 s
Vitesse de sortie
238 tok/s
TTFT p95
3.63 s
Taux d'erreur
0%

Benchmarks publics

10.7
AA Coding
Meilleur que 2 % des modèles comparés
n°118 sur 123
3.6
AA Intelligence
Meilleur que 0 % des modèles comparés
n°122 sur 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Source: artificialanalysis.ai

Comparatif

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrée $/M$3.00$21.00$60.00$5.00
Sortie $/M$4.00$168.00$270.00$30.00
Contexte16K400K1.1M
Qualité2/1010/1010/1010/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût de GPT-3.5 Turbo 16k sur OrcaRouter ?
Le coût est de 3,00 $ par million de tokens d’entrée et de 4,00 $ par million de tokens de sortie, facturé au tarif exact du fournisseur OpenAI sans marge bénéficiaire. Il n’y a pas de frais de plateforme supplémentaires.
Quelle est la taille de la fenêtre de contexte ?
Le modèle supporte une fenêtre de contexte de 16,385 tokens et une sortie maximale de 4,096 tokens. Il ne prend en charge que l'entrée de texte.
Quels sont les points forts de ce modèle par rapport à GPT-3.5 Turbo 4k ?
Le principal atout est son contexte de 16k, vous permettant de traiter des documents ou des conversations plus longs en une seule requête sans les diviser. Les performances sur les benchmarks sont également légèrement meilleures : 46.2 sur MMLU‑Pro contre environ 43 sur le MMLU standard pour la variante 4k.
Comment se compare-t-il à GPT-4 ?
GPT-3.5 Turbo 16k est beaucoup moins performant en matière de raisonnement, d'exactitude factuelle et de tâches nuancées. GPT‑4 obtient un score >80 au MMLU et gère mieux la logique complexe, mais coûte 10 à 20 fois plus cher et est plus lent. Utilisez GPT-3.5 Turbo 16k lorsque vous avez besoin d'un contexte étendu mais pas de raisonnement avancé.
Comment OrcaRouter gère-t-il mes données lorsque j'utilise ce modèle ?
OrcaRouter agit comme un proxy : il transmet votre requête API à OpenAI et renvoie la réponse. Il ne stocke ni ne consigne le contenu des prompts au-delà du traitement transitoire des requêtes. Pour plus de détails sur le traitement des données, veuillez consulter la politique de confidentialité d'OrcaRouter et les conditions d'utilisation des données d'OpenAI.
Comment appeler ce modèle en utilisant une API compatible OpenAI ?
Définissez votre URL de base sur https://api.orcarouter.ai/v1 et utilisez l’ID de modèle « openai/gpt-3.5-turbo-16k ». Tous les autres paramètres de complétion de chat (messages, temperature, max_tokens, etc.) fonctionnent à l’identique de l’API OpenAI.
Que se passe-t-il si je dépasse la limite de 16,384 tokens ?
OrcaRouter renverra une erreur indiquant que le nombre combiné de jetons de prompt et de complétion dépasse la fenêtre de contexte du modèle. Vous devez raccourcir l’entrée, réduire max_tokens ou diviser la requête en plusieurs appels.
Puis-je utiliser le streaming avec ce modèle ?
Oui, définissez le paramètre stream sur true dans votre requête. OrcaRouter renverra les jetons sous forme d'événements de données, suivant le même format que l'API de streaming OpenAI.
Y a-t-il un montant minimum ou un engagement ?
Non. Vous payez uniquement pour les jetons utilisés. Il n'y a pas de frais d'abonnement, d'engagement mensuel minimum, ni de remises sur volume. La tarification est strictement à l'utilisation.

Intégrer ce badge

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k sur OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Fiche du modèle en données

GET /api/public/models/openai/gpt-3.5-turbo-16kOuvrir
Lisible par machine:/llms.txt/llms-full.txt