openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
AlatJSON
oleh openai

Model teks hemat biaya dari OpenAI dengan skor MMLU-Pro 46.2, diakses melalui API OrcaRouter.

Output maks4.1K
Masukantext
p50 TTFT3.64 s
INPUT$0.50/ 1M token
OUTPUT$1.50/ 1M token
p50 TTFT3.64 s7h
p95 TTFT3.64 s7h
LALU LINTAS5.8Ktoken / 7h

openai/gpt-3.5-turbo-0125 adalah model generasi teks yang dikembangkan oleh OpenAI dan tersedia melalui API OrcaRouter. Model ini merupakan bagian dari keluarga GPT-3.5-Turbo, yang dioptimalkan untuk…

Apa itu openai/gpt-3.5-turbo-0125?

Siapa yang harus menggunakan model ini?

Bagaimana OrcaRouter memberikan model ini?

Apa karakteristik input/output?

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Harga

Input / 1M token$0.500
Output / 1M token$1.50
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $8.00

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000759

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
3.64 s
Kecepatan output
Mengumpulkan…
p95 TTFT
3.64 s
Tingkat kesalahan
0%

Benchmark publik

10.7
AA Coding
Lebih baik dari 2% model yang dibandingkan
#118 dari 123
3.6
AA Intelligence
Lebih baik dari 0% model yang dibandingkan
#122 dari 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Sumber: artificialanalysis.ai

Perbandingan

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.50$21.00$60.00$5.00
Output $/M$1.50$168.00$270.00$30.00
Konteks400K1.1M
Kualitas2/1010/1010/1010/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa biaya untuk menggunakan openai/gpt-3.5-turbo-0125 di OrcaRouter?
Harga persis dengan tarif langsung OpenAI tanpa markup: $0,50 per 1 juta token input dan $1,50 per 1 juta token output. Tidak ada biaya tambahan.
Berapa ukuran jendela konteksnya?
Model ini mendukung total konteks sebanyak 16.385 token (input + output), dengan output dibatasi maksimal 4.096 token per generasi. Ini adalah informasi publik yang dikenal luas untuk versi model ini.
Apa kelebihan utama dari model ini?
Ini menawarkan keseimbangan yang kuat antara kecepatan, biaya, dan kualitas untuk tugas teks. Ini memperoleh skor 46.2 pada MMLU-Pro dan secara andal menangani pengikutan instruksi, chat, serta output terstruktur.
Bagaimana perbandingannya dengan GPT-4?
GPT-4 mengunggulinya dalam penalaran kompleks tetapi biayanya jauh lebih tinggi per token. Gunakan GPT-3.5-Turbo-0125 untuk aplikasi yang sensitif terhadap biaya atau volume tinggi di mana akurasi mendekati GPT-4 tidak diperlukan.
Apakah OrcaRouter mencatat atau menyimpan data saya?
OrcaRouter memproses permintaan ke API OpenAI. Ia tidak mencatat atau menyimpan prompt atau completion melebihi yang diperlukan untuk penagihan dan keamanan operasional. Tinjau kebijakan privasi OpenAI untuk penanganan data mereka.
Bagaimana cara memanggil model ini menggunakan API yang kompatibel dengan OpenAI?
Atur base URL menjadi https://api.orcarouter.ai/v1, model menjadi 'openai/gpt-3.5-turbo-0125', dan gunakan kunci API OrcaRouter Anda di header Authorization. Format chat completions standar berfungsi.
Bisakah saya melakukan streaming respons?
Ya. Atur parameter 'stream' menjadi true dalam permintaan Anda. Respons akan dikirim sebagai server-sent events dengan delta token, sesuai dengan format streaming OpenAI.
Berapa panjang output maksimum?
Model dapat menghasilkan hingga 4096 token dalam satu respons. Gunakan parameter 'max_tokens' untuk mengontrol ini, tetapi tidak boleh melebihi 4096.
Apakah model ini cocok untuk tugas multibahasa?
Ia bekerja di berbagai bahasa tetapi berkinerja terbaik dalam bahasa Inggris. Akurasi mungkin menurun untuk bahasa dengan sumber daya rendah atau ekspresi idiomatik yang kompleks.

Sematkan lencana ini

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 di OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Kartu model sebagai data

GET /api/public/models/openai/gpt-3.5-turbo-0125Buka