GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k
Công cụJSON
bởi OpenAI · 2023-08-28

Mô hình này cung cấp độ dài ngữ cảnh gấp bốn lần gpt-3.5-turbo, cho phép nó hỗ trợ khoảng 20 trang văn bản trong một yêu cầu duy nhất với chi phí cao hơn. Dữ liệu đào tạo: lên đến...

Điểm cuối:/v1/chat/completions
ngữ cảnh16.4K token
Đầu ra tối đa4.1K
Đầu vàotext
Đầu ratext
TTFT p502.00 s
ĐẦU VÀO$3.00/ 1M token
ĐẦU RA$4.00/ 1M token
TTFT p502.00 s7 ngày
p95 TTFT3.63 s7 ngày
LƯU LƯỢNG16.8Ktokens / 7 ngày

GPT-3.5 Turbo 16k là phiên bản ngữ cảnh mở rộng của mô hình GPT-3.5 Turbo của OpenAI, ban đầu được phát hành để hỗ trợ các tác vụ yêu cầu xử lý lượng văn bản lớn hơn mà không cần chia nhỏ. Dung lượng…

GPT-3.5 Turbo 16k là gì?

Mô hình này dành cho ai?

Các thông số kỹ thuật chính là gì?

OrcaRouter cung cấp quyền truy cập như thế nào?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-16k",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Giá

Đầu vào / 1M tokens$3.00
Đầu ra / 1M tokens$4.00
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $33.00

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.002051

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
2.00 s
Tốc độ đầu ra
238 tok/s
p95 TTFT
3.63 s
Tỷ lệ lỗi
0%

Benchmark công khai

10.7
AA Coding
Tốt hơn 2% số mô hình được so sánh
#118 / 123
3.6
AA Intelligence
Tốt hơn 0% số mô hình được so sánh
#122 / 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Nguồn: artificialanalysis.ai

So sánh

GPT-3.5 Turbo 16kGPT-5.2 ProGPT-5.4 ProGPT-5.5
Đầu vào $/M$3.00$21.00$60.00$5.00
Đầu ra $/M$4.00$168.00$270.00$30.00
Ngữ cảnh16K400K1.1M
Chất lượng2/1010/1010/1010/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí của GPT-3.5 Turbo 16k trên OrcaRouter là bao nhiêu?
Chi phí là $3.00 cho mỗi 1M token đầu vào và $4.00 cho mỗi 1M token đầu ra, được tính theo đúng tỷ giá của nhà cung cấp OpenAI với 0% phụ phí. Không có thêm phí nền tảng nào.
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Mô hình hỗ trợ cửa sổ ngữ cảnh 16,385 token và đầu ra tối đa 4,096 token. Nó chỉ xử lý đầu vào văn bản.
Điểm mạnh của mô hình này so với GPT-3.5 Turbo 4k là gì?
Điểm mạnh chính là ngữ cảnh 16k, cho phép bạn xử lý các tài liệu hoặc cuộc hội thoại dài hơn trong một yêu cầu duy nhất mà không cần chia nhỏ. Hiệu suất trên các benchmark cũng tốt hơn một chút: 46.2 trên MMLU‑Pro so với khoảng 43 trên MMLU tiêu chuẩn cho phiên bản 4k.
Nó so sánh với GPT-4 như thế nào?
GPT-3.5 Turbo 16k kém hơn nhiều về khả năng suy luận, độ chính xác thực tế và các tác vụ tinh vi. GPT‑4 đạt điểm >80 trên MMLU và xử lý logic phức tạp tốt hơn, nhưng đắt hơn 10‑20 lần và chậm hơn. Sử dụng GPT-3.5 Turbo 16k khi cần ngữ cảnh mở rộng nhưng không yêu cầu suy luận nâng cao.
OrcaRouter xử lý dữ liệu của tôi như thế nào khi tôi sử dụng mô hình này?
OrcaRouter hoạt động như một proxy: nó chuyển tiếp yêu cầu API của bạn tới OpenAI và trả về phản hồi. Nó không lưu trữ hoặc ghi lại nội dung prompt ngoài việc xử lý yêu cầu tạm thời. Để biết chi tiết về xử lý dữ liệu, hãy tham khảo chính sách bảo mật của OrcaRouter và các điều khoản sử dụng dữ liệu của OpenAI.
Làm thế nào để tôi gọi mô hình này bằng API tương thích với OpenAI?
Đặt URL cơ sở của bạn thành https://api.orcarouter.ai/v1 và sử dụng ID mô hình "openai/gpt-3.5-turbo-16k". Tất cả các tham số hoàn tất trò chuyện khác (messages, temperature, max_tokens, v.v.) hoạt động giống hệt như API OpenAI.
Nếu tôi vượt quá giới hạn 16.384 token thì sao?
OrcaRouter sẽ trả về lỗi cho biết rằng tổng số token của prompt và completion vượt quá cửa sổ ngữ cảnh của mô hình. Bạn cần rút ngắn đầu vào, giảm max_tokens, hoặc chia yêu cầu thành nhiều lần gọi.
Tôi có thể sử dụng streaming với mô hình này không?
Vâng, hãy đặt tham số stream thành true trong yêu cầu của bạn. OrcaRouter sẽ truyền lại các token dưới dạng data events, tuân theo cùng định dạng như OpenAI streaming API.
Có yêu cầu chi tiêu tối thiểu hay cam kết nào không?
Không. Bạn chỉ trả tiền cho các token đã sử dụng. Không có phí đăng ký, cam kết tối thiểu hàng tháng hay chiết khấu theo khối lượng. Giá cả hoàn toàn theo hình thức trả theo mức sử dụng.

Nhúng huy hiệu này

OpenAI: GPT-3.5 Turbo 16k$3.00/M in2000ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg" alt="OpenAI: GPT-3.5 Turbo 16k trên OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-3.5 Turbo 16k](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-16k.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-16k)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/openai/gpt-3.5-turbo-16kMở
Máy đọc được:/llms.txt/llms-full.txt