GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
도구JSON
제공 OpenAI · 2023-08-28

이 모델은 gpt-3.5-turbo의 컨텍스트 길이의 4배를 제공하여, 단일 요청에서 약 20페이지 분량의 텍스트를 지원할 수 있지만 비용이 더 높습니다. 학습 데이터: 최대...

엔드포인트:/v1/chat/completions
컨텍스트16.4K 토큰
최대 출력4.1K
입력text
출력text
p50 TTFT2.00 s
입력$3.00/ 100만 토큰
출력$4.00/ 100만 토큰
p50 TTFT2.00 s7일
p95 TTFT3.63 s7일
트래픽16.8K토큰 / 7일

GPT-3.5 Turbo 16k는 OpenAI의 GPT-3.5 Turbo 모델의 확장된 컨텍스트 버전으로, 원래 텍스트를 분할하지 않고도 더 많은 양의 텍스트를 처리해야 하는 작업을 지원하기 위해 출시되었습니다. 16,385개의 토큰(약 12,000단어)의 컨텍스트 창 용량을 통해 단일 추론 호출로 전체 기사, 대본 또는 코드 저장소를 처리할 수 있으며,…

GPT-3.5 Turbo 16k는 무엇인가요?

이 모델은 누구를 위한 것인가요?

주요 사양은 무엇인가요?

OrcaRouter는 어떻게 접근을 제공하나요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

가격

입력 / 1M tokens$3.00
출력 / 1M tokens$4.00
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $33.00

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.002027

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
2.00 s
출력 속도
238 tok/s
p95 TTFT
3.63 s
오류율
0%

공개 벤치마크

10.7
AA Coding
비교된 모델 중 2%보다 우수
123개 중 118위
3.6
AA Intelligence
비교된 모델 중 0%보다 우수
125개 중 122위
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
소스: artificialanalysis.ai

비교

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
입력 $/100만$3.00$21.00$60.00$5.00
출력 $/100만$4.00$168.00$270.00$30.00
컨텍스트16K400K1.1M
품질2/1010/1010/1010/10
나란히 비교나란히 비교나란히 비교나란히 비교

OpenAI의 다른 모델

FAQ

OrcaRouter에서 GPT-3.5 Turbo 16k의 비용은 얼마인가요?
비용은 1M 입력 토큰당 $3.00, 1M 출력 토큰당 $4.00이며, 정확한 OpenAI 제공자 요금으로 마크업 없이 청구됩니다. 추가 플랫폼 수수료는 없습니다.
컨텍스트 윈도우 크기는 얼마인가요?
모델은 16,385개의 토큰의 컨텍스트 창과 최대 4,096개의 토큰 출력을 지원합니다. 텍스트 입력만 처리합니다.
이 모델이 GPT-3.5 Turbo 4k와 비교했을 때 어떤 강점이 있나요?
주된 강점은 16k 컨텍스트로, 더 긴 문서나 대화를 분할하지 않고 단일 요청으로 처리할 수 있습니다. 벤치마크 성능도 약간 더 좋아서, MMLU‑Pro에서 46.2점, 4k 변형의 표준 MMLU에서 약 43점입니다.
GPT-4와 어떻게 비교되나요?
GPT-3.5 Turbo 16k는 추론, 사실 정확도, 미묘한 작업에서 훨씬 덜 능력이 있습니다. GPT‑4는 MMLU에서 >80점을 받으며 복잡한 논리를 더 잘 처리하지만, 10‑20배 더 비싸고 느립니다. 확장된 컨텍스트가 필요하지만 고급 추론이 필요하지 않은 경우 GPT-3.5 Turbo 16k를 사용하세요.
OrcaRouter는 제가 이 모델을 사용할 때 내 데이터를 어떻게 처리하나요?
OrcaRouter는 프록시 역할을 합니다: 귀하의 API 요청을 OpenAI로 전달하고 응답을 반환합니다. 일시적인 요청 처리 외에는 프롬프트 내용을 저장하거나 기록하지 않습니다. 자세한 데이터 처리에 대해서는 OrcaRouter의 개인정보 처리방침과 OpenAI의 데이터 사용 약관을 참조하세요.
OpenAI 호환 API를 사용하여 이 모델을 어떻게 호출하나요?
기본 URL을 https://api.orcarouter.ai/v1로 설정하고 모델 ID "openai/gpt-3.5-turbo-16k"를 사용하세요. 다른 모든 채팅 완료 매개변수(메시지, temperature, max_tokens 등)는 OpenAI API와 동일하게 작동합니다.
16,384‑토큰 제한을 초과하면 어떻게 되나요?
OrcaRouter는 결합된 프롬프트와 완성 토큰이 모델의 컨텍스트 윈도우를 초과했음을 나타내는 오류를 반환합니다. 입력을 줄이거나, max_tokens를 줄이거나, 요청을 여러 번 호출로 분할해야 합니다.
이 모델에서 스트리밍을 사용할 수 있나요?
예, 요청에서 stream 파라미터를 true로 설정하십시오. OrcaRouter는 OpenAI 스트리밍 API와 동일한 형식에 따라 데이터 이벤트로 토큰을 스트리밍하여 반환합니다.
최소 지출액이나 약정이 있나요?
아니요. 사용한 토큰에 대해서만 비용을 지불하시면 됩니다. 구독료, 최소 월 사용량 약정, 또는 볼륨 할인은 없습니다. 가격은 엄격한 종량제입니다.

이 배지 임베드

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OrcaRouter 의 OpenAI: GPT-3.5 Turbo 16k" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

모델 카드를 데이터로

GET /api/public/models/openai/gpt-3.5-turbo-16k열기
기계 판독 가능:/llms.txt/llms-full.txt