GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
StrumentiJSON
di OpenAI · 2023-08-28

Questo modello offre quattro volte la lunghezza del contesto di gpt-3.5-turbo, permettendogli di supportare circa 20 pagine di testo in una singola richiesta a un costo maggiore. Dati di addestramento: fino a...

ctx16.4K token
Output max4.1K
Inputtext
Outputtext
p50 TTFT2.00 s
INGRESSO$3.00/ 1M token
USCITA$4.00/ 1M token
p50 TTFT2.00 s7 g
p95 TTFT3.63 s7 g
TRAFFICO16.8Ktoken / 7 g

GPT-3.5 Turbo 16k è una versione con contesto esteso del modello GPT-3.5 Turbo di OpenAI, originariamente rilasciato per supportare attività che richiedono l'elaborazione di grandi quantità di testo…

Che cos'è GPT-3.5 Turbo 16k?

A chi è destinato questo modello?

Quali sono le specifiche chiave?

Come fa OrcaRouter a fornire l'accesso?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Prezzi

Input / 1M token$3.00
Output / 1M token$4.00
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $33.00

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.002051

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
2.00 s
Velocità di output
238 tok/s
p95 TTFT
3.63 s
Tasso di errore
0%

Benchmark pubblici

10.7
AA Coding
Migliore del 2% dei modelli confrontati
n. 118 su 123
3.6
AA Intelligence
Migliore del 0% dei modelli confrontati
n. 122 su 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Fonte: artificialanalysis.ai

A confronto

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$3.00$21.00$60.00$5.00
Output $/M$4.00$168.00$270.00$30.00
Contesto16K400K1.1M
Qualità2/1010/1010/1010/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo di GPT-3.5 Turbo 16k su OrcaRouter?
Il costo è di $3.00 per 1 milione di token di input e $4.00 per 1 milione di token di output, fatturati esattamente alla tariffa del provider OpenAI con zero margine. Non ci sono commissioni aggiuntive per la piattaforma.
Qual è la dimensione della finestra di contesto?
Il modello supporta una finestra di contesto di 16,385 token e un output massimo di 4,096 token. Gestisce solo input di testo.
Quali sono i punti di forza di questo modello rispetto a GPT-3.5 Turbo 4k?
Il punto di forza principale è il suo contesto di 16k, che ti consente di elaborare documenti o conversazioni più lunghi in una singola richiesta senza doverli dividere. Anche le prestazioni nei benchmark sono leggermente migliori: 46.2 su MMLU‑Pro rispetto a circa 43 su MMLU standard per la variante da 4k.
Come si confronta con GPT-4?
GPT-3.5 Turbo 16k è molto meno capace nel ragionamento, nell'accuratezza fattuale e nei compiti sfumati. GPT‑4 ottiene un punteggio superiore a 80 su MMLU e gestisce meglio la logica complessa, ma è da 10 a 20 volte più costoso e più lento. Utilizza GPT-3.5 Turbo 16k quando è necessario un contesto esteso ma non un ragionamento avanzato.
Come gestisce OrcaRouter i miei dati quando uso questo modello?
OrcaRouter funge da proxy: inoltra la tua richiesta API a OpenAI e restituisce la risposta. Non memorizza né registra i contenuti dei prompt oltre alla gestione transitoria delle richieste. Per informazioni dettagliate sulla gestione dei dati, consulta l'informativa sulla privacy di OrcaRouter e i termini di utilizzo dei dati di OpenAI.
Come faccio a chiamare questo modello usando un'API compatibile con OpenAI?
Imposta il tuo URL di base su https://api.orcarouter.ai/v1 e usa l'ID del modello "openai/gpt-3.5-turbo-16k". Tutti gli altri parametri di completamento chat (messages, temperature, max_tokens, ecc.) funzionano in modo identico all'API di OpenAI.
E se supero il limite di 16,384 token?
OrcaRouter restituirà un errore indicando che i token combinati del prompt e del completamento superano la finestra di contesto del modello. È necessario accorciare l'input, ridurre max_tokens o suddividere la richiesta in più chiamate.
Posso usare lo streaming con questo modello?
Sì, imposta il parametro stream su true nella tua richiesta. OrcaRouter trasmetterà i token come eventi di dati, seguendo lo stesso formato dell'API di streaming di OpenAI.
È previsto un importo minimo di spesa o un impegno?
No. Paghi solo per i token utilizzati. Non ci sono canoni di abbonamento, impegni mensili minimi o sconti sul volume. Il prezzo è strettamente a consumo.

Incorpora questo badge

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k su OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Scheda del modello come dati

GET /api/public/models/openai/gpt-3.5-turbo-16kApri
Leggibile dalle macchine:/llms.txt/llms-full.txt