GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
ToolsJSON
von OpenAI · 2023-08-28

Dieses Modell bietet die vierfache Kontextlänge von gpt-3.5-turbo und ermöglicht so die Unterstützung von etwa 20 Seiten Text in einer einzigen Anfrage zu höheren Kosten. Trainingsdaten: bis...

Ktx16.4K Tokens
Max. Ausgabe4.1K
Eingabetext
Ausgabetext
p50 TTFT2.00 s
EINGABE$3.00/ 1M Tokens
AUSGABE$4.00/ 1M Tokens
p50 TTFT2.00 s7 T
p95 TTFT3.63 s7 T
DATENVERKEHR16.8KTokens / 7 T

GPT-3.5 Turbo 16k ist eine erweiterte Kontextversion von OpenAIs GPT-3.5 Turbo Modell, die ursprünglich veröffentlicht wurde, um Aufgaben zu unterstützen, die die Verarbeitung größerer Textmengen…

Was ist GPT-3.5 Turbo 16k?

Für wen ist dieses Modell?

Was sind die wichtigsten Spezifikationen?

Wie stellt OrcaRouter den Zugriff bereit?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$3.00
Ausgabe / 1M Tokens$4.00
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $33.00

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.002081

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
2.00 s
Ausgabegeschwindigkeit
238 tok/s
p95 TTFT
3.63 s
Fehlerquote
0%

Öffentliche Benchmarks

10.7
AA Coding
Besser als 2 % der verglichenen Modelle
Nr. 118 von 123
3.6
AA Intelligence
Besser als 0 % der verglichenen Modelle
Nr. 122 von 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Quelle: artificialanalysis.ai

Im Vergleich

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Eingabe $/M$3.00$21.00$60.00$5.00
Ausgabe $/M$4.00$168.00$270.00$30.00
Kontext16K400K1.1M
Qualität2/1010/1010/1010/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was sind die Kosten von GPT-3.5 Turbo 16k auf OrcaRouter?
Die Kosten betragen $3.00 pro 1M Input-Token und $4.00 pro 1M Output-Token, abgerechnet zum genauen OpenAI-Anbieterpreis ohne Aufschlag. Es fallen keine zusätzlichen Plattformgebühren an.
Wie groß ist das Kontextfenster?
Das Modell unterstützt ein Kontextfenster von 16.385 Tokens und eine maximale Ausgabe von 4.096 Tokens. Es verarbeitet nur Texteingaben.
Was sind die Stärken dieses Modells im Vergleich zu GPT-3.5 Turbo 4k?
Die Hauptstärke ist der 16k Kontext, der es Ihnen ermöglicht, längere Dokumente oder Unterhaltungen in einer einzigen Anfrage zu verarbeiten, ohne sie aufteilen zu müssen. Die Leistung bei Benchmarks ist ebenfalls etwas besser: 46.2 auf MMLU‑Pro gegenüber etwa 43 auf standard MMLU für die 4k Variante.
Wie schneidet es im Vergleich zu GPT-4 ab?
GPT-3.5 Turbo 16k ist weit weniger leistungsfähig in Bezug auf logisches Denken, faktische Genauigkeit und differenzierte Aufgaben. GPT‑4 erreicht >80 beim MMLU und bewältigt komplexe Logik besser, ist aber 10‑20x teurer und langsamer. Verwenden Sie GPT-3.5 Turbo 16k, wenn ein erweiterter Kontext benötigt wird, aber fortgeschrittenes logisches Denken nicht erforderlich ist.
Wie behandelt OrcaRouter meine Daten, wenn ich dieses Modell verwende?
OrcaRouter fungiert als Proxy: Es leitet Ihre API-Anfrage an OpenAI weiter und gibt die Antwort zurück. Es speichert oder protokolliert keine Prompt-Inhalte über die vorübergehende Bearbeitung der Anfrage hinaus. Einzelheiten zur Datenverarbeitung finden Sie in der Datenschutzrichtlinie von OrcaRouter und den Datennutzungsbedingungen von OpenAI.
Wie rufe ich dieses Modell mit einer OpenAI-kompatiblen API auf?
Setzen Sie Ihre Basis-URL auf https://api.orcarouter.ai/v1 und verwenden Sie die Modell-ID "openai/gpt-3.5-turbo-16k". Alle anderen Chat-Completion-Parameter (Nachrichten, Temperatur, max_tokens, etc.) funktionieren identisch zur OpenAI-API.
Was passiert, wenn ich das 16.384‑Token‑Limit überschreite?
OrcaRouter gibt einen Fehler zurück, der angibt, dass die kombinierten Prompt- und Completion-Tokens das Kontextfenster des Modells überschreiten. Sie müssen die Eingabe kürzen, max_tokens reduzieren oder die Anfrage in mehrere Aufrufe aufteilen.
Kann ich Streaming mit diesem Modell verwenden?
Ja, setzen Sie den Parameter „stream“ in Ihrer Anfrage auf true. OrcaRouter streamt Token als Datenereignisse zurück, die dem gleichen Format wie die OpenAI-Streaming-API folgen.
Gibt es einen Mindestumsatz oder eine Mindestabnahme?
Nein. Sie bezahlen nur für die verwendeten Tokens. Es gibt keine Abonnementgebühren, monatliche Mindestverpflichtungen oder Mengenrabatte. Die Preisgestaltung ist streng nach dem Prinzip „Pay-as-you-go“.

Dieses Abzeichen einbetten

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k auf OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Modellkarte als Daten

GET /api/public/models/openai/gpt-3.5-turbo-16kÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt