openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
Công cụJSON
bởi openai

Mô hình văn bản hiệu quả về chi phí từ OpenAI với điểm MMLU-Pro 46.2, truy cập qua API OrcaRouter.

Điểm cuối:/v1/chat/completions
Đầu ra tối đa4.1K
Đầu vàotext
TTFT p503.64 s
ĐẦU VÀO$0.50/ 1M token
ĐẦU RA$1.50/ 1M token
TTFT p503.64 s7 ngày
p95 TTFT3.64 s7 ngày
LƯU LƯỢNG5.8Ktokens / 7 ngày

openai/gpt-3.5-turbo-0125 là một mô hình tạo văn bản do OpenAI phát triển và có sẵn qua API của OrcaRouter. Nó thuộc dòng GPT-3.5-Turbo, được tối ưu hóa cho các tác vụ hội thoại và đầu ra văn bản có…

openai/gpt-3.5-turbo-0125 là gì?

Ai nên sử dụng mô hình này?

OrcaRouter phân phối mô hình này như thế nào?

Đặc tính đầu vào/đầu ra là gì?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Giá

Đầu vào / 1M tokens$0.500
Đầu ra / 1M tokens$1.50
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $8.00

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000759

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
3.64 s
Tốc độ đầu ra
Đang thu thập…
p95 TTFT
3.64 s
Tỷ lệ lỗi
0%

Benchmark công khai

10.7
AA Coding
Tốt hơn 2% số mô hình được so sánh
#118 / 123
3.6
AA Intelligence
Tốt hơn 0% số mô hình được so sánh
#122 / 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Nguồn: artificialanalysis.ai

So sánh

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Đầu vào $/M$0.50$21.00$60.00$5.00
Đầu ra $/M$1.50$168.00$270.00$30.00
Ngữ cảnh400K1.1M
Chất lượng2/1010/1010/1010/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí để sử dụng openai/gpt-3.5-turbo-0125 trên OrcaRouter là bao nhiêu?
Giá cả chính xác là giá trực tiếp của OpenAI với không có phụ phí: $0.50 cho mỗi 1 triệu token đầu vào và $1.50 cho mỗi 1 triệu token đầu ra. Không có khoản phí bổ sung nào.
Kích thước cửa sổ ngữ cảnh là bao nhiêu?
Mô hình hỗ trợ tổng ngữ cảnh 16,385 token (đầu vào + đầu ra), với đầu ra bị giới hạn ở mức 4096 token mỗi lần sinh. Đây là thông tin công khai được biết đến rộng rãi cho phiên bản mô hình này.
Các điểm mạnh chính của mô hình này là gì?
Nó cung cấp sự cân bằng tốt giữa tốc độ, chi phí và chất lượng cho các tác vụ văn bản. Nó đạt điểm 46.2 trên MMLU-Pro và xử lý việc tuân theo hướng dẫn, trò chuyện và đầu ra có cấu trúc một cách đáng tin cậy.
Nó so sánh với GPT-4 như thế nào?
GPT-4 vượt trội hơn trong các tác vụ suy luận phức tạp nhưng chi phí mỗi token cao hơn đáng kể. Sử dụng GPT-3.5-Turbo-0125 cho các ứng dụng nhạy cảm chi phí hoặc khối lượng lớn mà không yêu cầu độ chính xác gần bằng GPT-4.
OrcaRouter có ghi lại hoặc lưu trữ dữ liệu của tôi không?
OrcaRouter xử lý các yêu cầu đến API của OpenAI. Nó không ghi nhật ký hoặc lưu trữ lời nhắc hoặc kết quả hoàn thành ngoài những gì cần thiết cho việc thanh toán và bảo mật vận hành. Hãy xem xét chính sách bảo mật của OpenAI về cách họ xử lý dữ liệu.
Làm thế nào để tôi gọi mô hình này bằng API tương thích với OpenAI?
Đặt URL cơ sở thành https://api.orcarouter.ai/v1, mô hình thành 'openai/gpt-3.5-turbo-0125', và sử dụng khóa API OrcaRouter của bạn trong header Authorization. Định dạng hoàn thành trò chuyện tiêu chuẩn hoạt động.
Tôi có thể nhận phản hồi dạng luồng không?
Vâng. Đặt tham số 'stream' thành true trong yêu cầu của bạn. Phản hồi sẽ được gửi dưới dạng sự kiện do máy chủ gửi với delta mã thông báo, phù hợp với định dạng streaming của OpenAI.
Độ dài đầu ra tối đa là bao nhiêu?
Mô hình có thể tạo ra tối đa 4096 token trong một phản hồi duy nhất. Sử dụng tham số 'max_tokens' để kiểm soát điều này, nhưng nó không thể vượt quá 4096.
Mô hình này có phù hợp cho các tác vụ đa ngôn ngữ không?
Nó hoạt động trên nhiều ngôn ngữ nhưng hoạt động tốt nhất bằng tiếng Anh. Độ chính xác có thể giảm đối với các ngôn ngữ ít tài nguyên hoặc các biểu đạt thành ngữ phức tạp.

Nhúng huy hiệu này

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 trên OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/openai/gpt-3.5-turbo-0125Mở
Máy đọc được:/llms.txt/llms-full.txt