GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
ToolsJSON
von OpenAI · 2023-08-28

Dieses Modell bietet die vierfache Kontextlänge von gpt-3.5-turbo und ermöglicht so die Unterstützung von etwa 20 Seiten Text in einer einzigen Anfrage zu höheren Kosten. Trainingsdaten: bis...

Ktx16K Tokens
Max. Ausgabe4K
Eingabetext
Ausgabetext
p50 TTFT1.75 s
EINGABE$3.00/ 1M Tokens
AUSGABE$4.00/ 1M Tokens
p50 TTFT1.75 s7 T
p95 TTFT6.30 s7 T
DATENVERKEHR39.9KTokens / 7 T

GPT-3.5 Turbo 16k ist eine erweiterte Kontextversion von OpenAIs GPT-3.5 Turbo Modell, die ursprünglich veröffentlicht wurde, um Aufgaben zu unterstützen, die die Verarbeitung größerer Textmengen…

Was ist GPT-3.5 Turbo 16k?

Für wen ist dieses Modell?

Was sind die wichtigsten Spezifikationen?

Wie stellt OrcaRouter den Zugriff bereit?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$3.00
Ausgabe / 1M Tokens$4.00
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $33.00

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.002081

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
1.75 s
Ausgabegeschwindigkeit
172 tok/s
p95 TTFT
6.30 s
Fehlerquote
0%

Öffentliche Benchmarks

10.7
AA Coding
Besser als 2 % der verglichenen Modelle
Nr. 127 von 132
3.2
AA Intelligence
Besser als 0 % der verglichenen Modelle
Nr. 131 von 134
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Quelle: artificialanalysis.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News0 Erwähnungen · 7 T

Im Vergleich

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Eingabe $/M$3.00$21.00$60.00$5.00
Ausgabe $/M$4.00$168.00$270.00$30.00
Kontext16K400K1.1M
Qualität2/1010/1010/1010/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was sind die Kosten von GPT-3.5 Turbo 16k auf OrcaRouter?
Die Kosten betragen $3.00 pro 1M Input-Token und $4.00 pro 1M Output-Token, abgerechnet zum genauen OpenAI-Anbieterpreis ohne Aufschlag. Es fallen keine zusätzlichen Plattformgebühren an.
Wie groß ist das Kontextfenster?
Das Modell unterstützt ein Kontextfenster von 16.385 Tokens und eine maximale Ausgabe von 4.096 Tokens. Es verarbeitet nur Texteingaben.
Was sind die Stärken dieses Modells im Vergleich zu GPT-3.5 Turbo 4k?
Die Hauptstärke ist der 16k Kontext, der es Ihnen ermöglicht, längere Dokumente oder Unterhaltungen in einer einzigen Anfrage zu verarbeiten, ohne sie aufteilen zu müssen. Die Leistung bei Benchmarks ist ebenfalls etwas besser: 46.2 auf MMLU‑Pro gegenüber etwa 43 auf standard MMLU für die 4k Variante.
Wie schneidet es im Vergleich zu GPT-4 ab?
GPT-3.5 Turbo 16k ist weit weniger leistungsfähig in Bezug auf logisches Denken, faktische Genauigkeit und differenzierte Aufgaben. GPT‑4 erreicht >80 beim MMLU und bewältigt komplexe Logik besser, ist aber 10‑20x teurer und langsamer. Verwenden Sie GPT-3.5 Turbo 16k, wenn ein erweiterter Kontext benötigt wird, aber fortgeschrittenes logisches Denken nicht erforderlich ist.
Wie behandelt OrcaRouter meine Daten, wenn ich dieses Modell verwende?
OrcaRouter fungiert als Proxy: Es leitet Ihre API-Anfrage an OpenAI weiter und gibt die Antwort zurück. Es speichert oder protokolliert keine Prompt-Inhalte über die vorübergehende Bearbeitung der Anfrage hinaus. Einzelheiten zur Datenverarbeitung finden Sie in der Datenschutzrichtlinie von OrcaRouter und den Datennutzungsbedingungen von OpenAI.
Wie rufe ich dieses Modell mit einer OpenAI-kompatiblen API auf?
Setzen Sie Ihre Basis-URL auf https://api.orcarouter.ai/v1 und verwenden Sie die Modell-ID "openai/gpt-3.5-turbo-16k". Alle anderen Chat-Completion-Parameter (Nachrichten, Temperatur, max_tokens, etc.) funktionieren identisch zur OpenAI-API.
Was passiert, wenn ich das 16.384‑Token‑Limit überschreite?
OrcaRouter gibt einen Fehler zurück, der angibt, dass die kombinierten Prompt- und Completion-Tokens das Kontextfenster des Modells überschreiten. Sie müssen die Eingabe kürzen, max_tokens reduzieren oder die Anfrage in mehrere Aufrufe aufteilen.
Kann ich Streaming mit diesem Modell verwenden?
Ja, setzen Sie den Parameter „stream“ in Ihrer Anfrage auf true. OrcaRouter streamt Token als Datenereignisse zurück, die dem gleichen Format wie die OpenAI-Streaming-API folgen.
Gibt es einen Mindestumsatz oder eine Mindestabnahme?
Nein. Sie bezahlen nur für die verwendeten Tokens. Es gibt keine Abonnementgebühren, monatliche Mindestverpflichtungen oder Mengenrabatte. Die Preisgestaltung ist streng nach dem Prinzip „Pay-as-you-go“.

Dieses Abzeichen einbetten

OpenAI: GPT-3.5 Turbo 16k$3.00/M in1750ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k auf OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Modellkarte als Daten

GET /api/public/models/openai/gpt-3.5-turbo-16kÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt