GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
เครื่องมือJSON
โดย OpenAI · 2023-08-28

โมเดลนี้มีความยาวของบริบทมากกว่า gpt-3.5-turbo ถึงสี่เท่า ทำให้สามารถรองรับข้อความประมาณ 20 หน้าในคำขอเดียว ด้วยต้นทุนที่สูงขึ้น ข้อมูลการฝึกอบรม: ถึง...

เอนด์พอยต์:/v1/chat/completions
ctx16.4K โทเค็น
เอาต์พุตสูงสุด4.1K
อินพุตtext
เอาต์พุตtext
p50 TTFT2.00 s
INPUT$3.00/ 1M โทเค็น
OUTPUT$4.00/ 1M โทเค็น
p50 TTFT2.00 s7 วัน
p95 TTFT3.63 s7 วัน
ทราฟฟิก16.8Kโทเค็น / 7วัน
รับ API ของ GPT-3.5 Turbo 16k ลองใน playground</> ใช้ผ่าน API

GPT-3.5 Turbo 16k เป็นเวอร์ชันที่มีบริบทขยายของโมเดล GPT-3.5 Turbo ของ OpenAI ซึ่งเปิดตัวครั้งแรกเพื่อรองรับงานที่ต้องมีการประมวลผลข้อความปริมาณมากโดยไม่ต้องแบ่งส่วน ขนาดหน้าต่างบริบท 16,385 โทเค็น…

GPT-3.5 Turbo 16k คืออะไร?

โมเดลนี้เหมาะสำหรับใคร?

ข้อกำหนดหลักคืออะไร?

OrcaRouter ให้การเข้าถึงได้อย่างไร?

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

ราคา

อินพุต / 1M โทเค็น$3.00
เอาต์พุต / 1M โทเค็น$4.00
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $33.00

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.002039

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
2.00 s
ความเร็วเอาต์พุต
238 tok/s
p95 TTFT
3.63 s
อัตราข้อผิดพลาด
0%

เกณฑ์มาตรฐานสาธารณะ

10.7
AA Coding
ดีกว่า 2% ของโมเดลที่เปรียบเทียบ
อันดับ 118 จาก 123
3.6
AA Intelligence
ดีกว่า 0% ของโมเดลที่เปรียบเทียบ
อันดับ 122 จาก 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
แหล่งที่มา: artificialanalysis.ai

การเปรียบเทียบ

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
อินพุต $/ล้าน$3.00$21.00$60.00$5.00
เอาต์พุต $/ล้าน$4.00$168.00$270.00$30.00
บริบท16K400K1.1M
คุณภาพ2/1010/1010/1010/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก OpenAI

FAQ

ค่าใช้จ่ายของ GPT-3.5 Turbo 16k บน OrcaRouter คืออะไร?
ค่าใช้จ่ายอยู่ที่ $3.00 ต่อ 1M input tokens และ $4.00 ต่อ 1M output tokens คิดตามอัตราของผู้ให้บริการ OpenAI อย่างตรงไปตรงมาโดยไม่มีส่วนเพิ่ม ไม่มีค่าธรรมเนียมแพลตฟอร์มเพิ่มเติม
ขนาดหน้าต่างบริบทคือเท่าไร?
โมเดลนี้รองรับหน้าต่างบริบทจำนวน 16,385 โทเค็น และเอาต์พุตสูงสุด 4,096 โทเค็น รองรับเฉพาะการป้อนข้อมูลข้อความเท่านั้น
โมเดลนี้มีจุดแข็งอะไรบ้างเมื่อเทียบกับ GPT-3.5 Turbo 4k?
จุดแข็งหลักคือบริบท 16k ซึ่งช่วยให้คุณสามารถประมวลผลเอกสารหรือการสนทนาที่ยาวขึ้นในคำขอเดียวโดยไม่ต้องแบ่งส่วน ผลลัพธ์ด้านประสิทธิภาพในการวัดมาตรฐานก็ดีขึ้นเล็กน้อยเช่นกัน: 46.2 บน MMLU‑Pro เทียบกับประมาณ 43 บน MMLU มาตรฐานสำหรับรุ่น 4k
มันเปรียบเทียบกับ GPT-4 อย่างไร?
GPT-3.5 Turbo 16k มีความสามารถน้อยกว่ามากในด้านการใช้เหตุผล ความถูกต้องตามข้อเท็จจริง และงานที่ต้องการความละเอียดอ่อน GPT‑4 ได้คะแนน >80 ในการทดสอบ MMLU และจัดการกับตรรกะที่ซับซ้อนได้ดีกว่า แต่มีราคาแพงกว่าและช้ากว่า 10‑20 เท่า ใช้ GPT-3.5 Turbo 16k เมื่อต้องการบริบทที่ยาวขึ้น แต่ไม่จำเป็นต้องใช้การให้เหตุผลขั้นสูง
OrcaRouter จัดการข้อมูลของฉันอย่างไรเมื่อฉันใช้โมเดลนี้
OrcaRouter ทำหน้าที่เป็นพร็อกซี: มันส่งต่อคำขอ API ของคุณไปยัง OpenAI และส่งคืนการตอบกลับ มันไม่จัดเก็บหรือบันทึกเนื้อหาพรอมต์นอกเหนือจากการจัดการคำขอชั่วคราว สำหรับรายละเอียดการจัดการข้อมูล โปรดดูนโยบายความเป็นส่วนตัวของ OrcaRouter และข้อกำหนดการใช้งานข้อมูลของ OpenAI
ฉันจะเรียกใช้โมเดลนี้ผ่าน API ที่เข้ากันได้กับ OpenAI ได้อย่างไร
ตั้งค่า URL พื้นฐานของคุณเป็น https://api.orcarouter.ai/v1 และใช้รหัสโมเดล "openai/gpt-3.5-turbo-16k" พารามิเตอร์การแชทคอมพลีชันอื่นๆ ทั้งหมด (messages, temperature, max_tokens, ฯลฯ) ทำงานเหมือนกับ OpenAI API ทุกประการ
แล้วถ้าฉันเกินขีดจำกัด 16,384‑โทเค็นล่ะ?
OrcaRouter จะส่งคืนข้อผิดพลาดที่ระบุว่าโทเค็นของ prompt และ completion รวมกันเกิน context window ของโมเดล คุณต้องป้อนข้อมูลให้สั้นลง ลดค่า max_tokens หรือแบ่งคำขอเป็นหลายๆ ครั้ง
ฉันสามารถใช้สตรีมมิ่งกับโมเดลนี้ได้ไหม?
ใช่ ตั้งค่าพารามิเตอร์ stream เป็น true ในคำขอของคุณ OrcaRouter จะสตรีมโทเค็นกลับมาเป็น events ข้อมูล ตามรูปแบบเดียวกับ API การสตรีมของ OpenAI
มีข้อกำหนดยอดใช้จ่ายขั้นต่ำหรือข้อผูกมัดใด ๆ หรือไม่
ไม่ คุณจ่ายเฉพาะตามจำนวนโทเค็นที่ใช้ ไม่มีค่าสมัครสมาชิก ข้อผูกมัดรายเดือนขั้นต่ำ หรือส่วนลดตามปริมาณ การกำหนดราคาเป็นแบบจ่ายตามการใช้งานจริงอย่างเคร่งครัด

ฝังป้ายนี้

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k บน OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

ข้อมูลโมเดลแบบ data

GET /api/public/models/openai/gpt-3.5-turbo-16kเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt