GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
AlatJSON
oleh OpenAI · 2023-08-28

Model ini menawarkan panjang konteks empat kali lipat dari gpt-3.5-turbo, memungkinkannya mendukung sekitar 20 halaman teks dalam satu permintaan dengan biaya yang lebih tinggi. Data pelatihan: hingga...

ctx16.4K token
Output maks4.1K
Masukantext
Keluarantext
p50 TTFT2.00 s
INPUT$3.00/ 1M token
OUTPUT$4.00/ 1M token
p50 TTFT2.00 s7h
p95 TTFT3.63 s7h
LALU LINTAS16.8Ktoken / 7h

GPT-3.5 Turbo 16k adalah versi dengan konteks yang diperpanjang dari model GPT-3.5 Turbo milik OpenAI, awalnya dirilis untuk mendukung tugas yang memerlukan pemrosesan teks dalam jumlah besar tanpa…

Apa itu GPT-3.5 Turbo 16k?

Untuk siapa model ini?

Apa saja spesifikasi kuncinya?

Bagaimana OrcaRouter menyediakan akses?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Harga

Input / 1M token$3.00
Output / 1M token$4.00
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $33.00

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.002051

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
2.00 s
Kecepatan output
238 tok/s
p95 TTFT
3.63 s
Tingkat kesalahan
0%

Benchmark publik

10.7
AA Coding
Lebih baik dari 2% model yang dibandingkan
#118 dari 123
3.6
AA Intelligence
Lebih baik dari 0% model yang dibandingkan
#122 dari 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Sumber: artificialanalysis.ai

Perbandingan

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$3.00$21.00$60.00$5.00
Output $/M$4.00$168.00$270.00$30.00
Konteks16K400K1.1M
Kualitas2/1010/1010/1010/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya GPT-3.5 Turbo 16k di OrcaRouter?
Biayanya adalah $3.00 per 1M token input dan $4.00 per 1M token output, ditagih dengan tarif persis dari penyedia OpenAI tanpa markup. Tidak ada biaya platform tambahan.
Berapa ukuran jendela konteksnya?
Model ini mendukung jendela konteks sebanyak 16,385 token dan output maksimum 4,096 token. Model ini hanya menangani input teks.
Apa kelebihan model ini dibandingkan dengan GPT-3.5 Turbo 4k?
Kekuatan utama adalah konteks 16k-nya, memungkinkan Anda memproses dokumen atau percakapan yang lebih panjang dalam satu permintaan tanpa pemisahan. Performa pada tolok ukur juga sedikit lebih baik: 46.2 pada MMLU‑Pro versus sekitar 43 pada MMLU standar untuk varian 4k.
Bagaimana perbandingannya dengan GPT-4?
GPT-3.5 Turbo 16k jauh kurang mampu dalam hal penalaran, akurasi faktual, dan tugas-tugas yang memerlukan nuansa. GPT‑4 mendapat skor >80 pada MMLU dan menangani logika kompleks lebih baik, tetapi harganya 10‑20 kali lebih mahal dan lebih lambat. Gunakan GPT-3.5 Turbo 16k ketika diperlukan konteks yang lebih panjang tetapi penalaran tingkat lanjut tidak diperlukan.
Bagaimana OrcaRouter menangani data saya saat saya menggunakan model ini?
OrcaRouter bertindak sebagai proxy: ia meneruskan permintaan API Anda ke OpenAI dan mengembalikan responsnya. OrcaRouter tidak menyimpan atau mencatat isi prompt di luar penanganan permintaan sementara. Untuk detail penanganan data, lihat kebijakan privasi OrcaRouter dan ketentuan penggunaan data OpenAI.
Bagaimana cara memanggil model ini menggunakan API yang kompatibel dengan OpenAI?
Atur URL dasar Anda ke https://api.orcarouter.ai/v1 dan gunakan ID model "openai/gpt-3.5-turbo-16k". Semua parameter chat‑completion lainnya (messages, temperature, max_tokens, dll.) berfungsi identik dengan API OpenAI.
Bagaimana jika saya melebihi batas 16,384‑token?
OrcaRouter akan mengembalikan galat yang menunjukkan bahwa token prompt dan completion gabungan melebihi jendela konteks model. Anda perlu memendekkan input, mengurangi max_tokens, atau membagi permintaan menjadi beberapa panggilan.
Bisakah saya menggunakan streaming dengan model ini?
Ya, atur parameter stream menjadi true dalam permintaan Anda. OrcaRouter akan mengalirkan token kembali sebagai data events, mengikuti format yang sama dengan API streaming OpenAI.
Apakah ada pengeluaran minimum atau komitmen?
Tidak. Anda hanya membayar untuk token yang digunakan. Tidak ada biaya berlangganan, komitmen bulanan minimum, atau diskon volume. Penetapan harga benar-benar bayar sesuai pemakaian.

Sematkan lencana ini

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k di OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Kartu model sebagai data

GET /api/public/models/openai/gpt-3.5-turbo-16kBuka