GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
VerktygJSON
av OpenAI · 2023-08-28

Denna modell erbjuder fyra gånger så stor kontextlängd som gpt-3.5-turbo, vilket gör att den kan stödja cirka 20 sidor text i en enda förfrågan till en högre kostnad. Träningsdata: upp...

ctx16.4K tokens
Max output4.1K
Inmatningtext
Utdatatext
p50 TTFT2.00 s
INMATNING$3.00/ 1M token
UTDATA$4.00/ 1M token
p50 TTFT2.00 s7d
p95 TTFT3.63 s7d
TRAFIK16.8Ktokens/7d

GPT-3.5 Turbo 16k är en utökad kontextversion av OpenAIs GPT-3.5 Turbo-modell, ursprungligen lanserad för att stödja uppgifter som kräver bearbetning av större mängder text utan att dela upp den.…

Vad är GPT-3.5 Turbo 16k?

Vem är den här modellen till för?

Vilka är de viktigaste specifikationerna?

Hur tillhandahåller OrcaRouter åtkomst?

Kodexempel

Anropa från valfritt SDK

OpenAI-kompatibel — behåll det SDK du redan använder

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametrar som stöds

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Priser

Inmatning / 1M token$3.00
Utdata / 1M tokens$4.00
ValutaUSD

Kostnadskalkylator

Token/månad10MM
Andel input70%%
Uppskattat/månad $33.00

Uppskattning baserad på listpris

Token- och kostnadsberäknare

Input-token: 18Kostnad per förfrågan: $0.002054

Endast en uppskattning — faktiskt antal token beror på leverantörens tokenizer.

Prestanda

p50 TTFT
2.00 s
Utdatahastighet
238 tok/s
p95 TTFT
3.63 s
Felfrekvens
0%

Offentliga benchmarks

10.7
AA Coding
Bättre än 2% av jämförda modeller
#118 av 123
3.6
AA Intelligence
Bättre än 0% av jämförda modeller
#122 av 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Källa: artificialanalysis.ai

Så jämför den sig

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$3.00$21.00$60.00$5.00
Output $/M$4.00$168.00$270.00$30.00
Kontext16K400K1.1M
Kvalitet2/1010/1010/1010/10
Jämför sida vid sidaJämför sida vid sidaJämför sida vid sidaJämför sida vid sida

Vanliga frågor

Vad är kostnaden för GPT-3.5 Turbo 16k på OrcaRouter?
Kostnaden är $3.00 per 1M inmatningstokens och $4.00 per 1M utmatningstokens, fakturerat till exakt OpenAI-leverantörspris utan påslag. Det finns inga extra plattformsavgifter.
Vad är storleken på kontextfönstret?
Modellen stödjer ett kontextfönster på 16,385 tokens och en maximal utdata på 4,096 tokens. Den hanterar endast textinmatning.
Vilka är styrkorna hos denna modell jämfört med GPT-3.5 Turbo 4k?
Den främsta styrkan är dess 16k kontext, vilket gör att du kan bearbeta längre dokument eller konversationer i en enda förfrågan utan att dela upp dem. Prestandan i riktmärken är också något bättre: 46.2 på MMLU‑Pro jämfört med cirka 43 på standard MMLU för 4k-varianterna.
Hur jämför den sig med GPT-4?
GPT-3.5 Turbo 16k är mycket mindre kapabel när det gäller resonemang, faktagranskning och nyanserade uppgifter. GPT‑4 får >80 på MMLU och hanterar komplex logik bättre, men är 10‑20x dyrare och långsammare. Använd GPT-3.5 Turbo 16k när utökat sammanhang behövs men avancerat resonemang inte gör det.
Hur hanterar OrcaRouter mina data när jag använder den här modellen?
OrcaRouter fungerar som en proxy: den vidarebefordrar din API-förfrågan till OpenAI och returnerar svaret. Den lagrar eller loggar inte promptinnehåll utöver tillfällig förfrågehantering. För detaljerad datahantering, se OrcaRouters integritetspolicy och OpenAIs användarvillkor för dataanvändning.
Hur anropar jag denna modell med ett OpenAI-kompatibelt API?
Ställ in din bas-URL till https://api.orcarouter.ai/v1 och använd modell-ID:t "openai/gpt-3.5-turbo-16k". Alla andra chattkompletteringsparametrar (messages, temperature, max_tokens, etc.) fungerar identiskt med OpenAI API.
Vad händer om jag överskrider gränsen på 16,384‑token?
OrcaRouter kommer att returnera ett fel som indikerar att de kombinerade prompt- och completion-tokens överskrider modellens kontextfönster. Du måste korta ned indata, minska max_tokens eller dela upp begäran i flera anrop.
Kan jag använda strömning med den här modellen?
Ja, ställ in stream-parametern på true i din begäran. OrcaRouter strömmar tillbaka tokens som datahändelser, enligt samma format som OpenAI:s streaming-API.
Finns det något minimibelopp eller åtagande?
Nej. Du betalar endast för använda tokens. Det finns inga prenumerationsavgifter, minimimånadsåtaganden eller volymrabatter. Priserna är strikt betala‑per‑användning.

Bädda in denna badge

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k på OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Modellkort som data

GET /api/public/models/openai/gpt-3.5-turbo-16kÖppna