GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
ToolsJSON
door OpenAI · 2023-08-28

Dit model biedt vier keer de contextlengte van gpt-3.5-turbo, waardoor het ongeveer 20 pagina's tekst in één verzoek kan ondersteunen tegen een hogere kostprijs. Trainingsdata: tot...

ctx16.4K tokens
Max. uitvoer4.1K
Invoertext
Uitvoertext
p50 TTFT2.00 s
INPUT$3.00/ 1M tokens
OUTPUT$4.00/ 1M tokens
p50 TTFT2.00 s7d
p95 TTFT3.63 s7d
VERKEER16.8Ktokens / 7d

GPT-3.5 Turbo 16k is een uitgebreide contextversie van OpenAI’s GPT-3.5 Turbo-model, oorspronkelijk uitgebracht om taken te ondersteunen die het verwerken van grotere hoeveelheden tekst vereisen…

Wat is GPT-3.5 Turbo 16k?

Voor wie is dit model?

Wat zijn de belangrijkste specificaties?

Hoe biedt OrcaRouter toegang?

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Prijzen

Invoer / 1M tokens$3.00
Uitvoer / 1M tokens$4.00
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $33.00

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.002060

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
2.00 s
Outputsnelheid
238 tok/s
p95 TTFT
3.63 s
Foutpercentage
0%

Openbare benchmarks

10.7
AA Coding
Beter dan 2% van de vergeleken modellen
#118 van 123
3.6
AA Intelligence
Beter dan 0% van de vergeleken modellen
#122 van 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Bron: artificialanalysis.ai

Vergelijking

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Invoer $/M$3.00$21.00$60.00$5.00
Uitvoer $/M$4.00$168.00$270.00$30.00
Context16K400K1.1M
Kwaliteit2/1010/1010/1010/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Wat kost GPT-3.5 Turbo 16k op OrcaRouter?
De kosten zijn $3.00 per 1M input tokens en $4.00 per 1M output tokens, gefactureerd tegen het exacte OpenAI-provider tarief zonder opslag. Er zijn geen extra platformkosten.
Wat is de grootte van het contextvenster?
Het model ondersteunt een contextvenster van 16,385 tokens en een maximale uitvoer van 4,096 tokens. Het verwerkt alleen tekstinvoer.
Wat zijn de sterke punten van dit model vergeleken met GPT-3.5 Turbo 4k?
De grootste kracht is de 16k context, waarmee u langere documenten of gesprekken in één verzoek kunt verwerken zonder te splitsen. De prestaties op benchmarks zijn ook iets beter: 46,2 op MMLU‑Pro versus ongeveer 43 op standaard MMLU voor de 4k variant.
Hoe verhoudt het zich tot GPT-4?
GPT-3.5 Turbo 16k is veel minder capabel op het gebied van redeneren, feitelijke nauwkeurigheid en genuanceerde taken. GPT‑4 scoort >80 op MMLU en gaat beter om met complexe logica, maar is 10‑20x duurder en trager. Gebruik GPT-3.5 Turbo 16k wanneer uitgebreide context nodig is, maar geavanceerd redeneren niet.
Hoe verwerkt OrcaRouter mijn gegevens wanneer ik dit model gebruik?
OrcaRouter fungeert als proxy: het stuurt uw API-verzoek door naar OpenAI en geeft het antwoord terug. Het slaat promptinhoud niet op of logt deze niet, behalve voor tijdelijk verzoekbeheer. Raadpleeg voor gedetailleerd gegevensbeheer het privacybeleid van OrcaRouter en de gebruiksvoorwaarden van OpenAI met betrekking tot gegevens.
Hoe roep ik dit model aan met een OpenAI-compatibele API?
Stel uw basis-URL in op https://api.orcarouter.ai/v1 en gebruik de model-ID "openai/gpt-3.5-turbo-16k". Alle andere chatvoltooiingsparameters (berichten, temperatuur, max_tokens, etc.) werken identiek aan de OpenAI API.
Wat als ik de 16,384‑tokenlimiet overschrijd?
OrcaRouter zal een foutmelding retourneren die aangeeft dat de gecombineerde prompt- en completietokens de contextvenster van het model overschrijden. U moet de invoer verkorten, max_tokens verlagen of het verzoek opsplitsen in meerdere aanroepen.
Kan ik streaming gebruiken met dit model?
Ja, zet de stream parameter op true in je verzoek. OrcaRouter zal tokens terugstreamen als data events, volgens hetzelfde formaat als de OpenAI streaming API.
Is er een minimale uitgave of verplichting?
Nee. U betaalt alleen voor gebruikte tokens. Er zijn geen abonnementskosten, minimale maandelijkse verplichtingen of volumekortingen. De prijs is strikt pay‑as‑you‑go.

Sluit deze badge in

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k op OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Modelkaart als data

GET /api/public/models/openai/gpt-3.5-turbo-16kOpenen
Machineleesbaar:/llms.txt/llms-full.txt