openai/gpt-3.5-turbo-0125

openai/gpt-3.5-turbo-0125
FerramentasJSON
por openai

Modelo de texto custo-benefício da OpenAI com pontuação 46.2 no MMLU-Pro, acessado via OrcaRouter API.

Saída máx.4.1K
Entradatext
p50 TTFT3.64 s
ENTRADA$0.50/ 1M tokens
SAÍDA$1.50/ 1M tokens
p50 TTFT3.64 s7 d
p95 TTFT3.64 s7 d
TRÁFEGO5.8Ktokens / 7 d

openai/gpt-3.5-turbo-0125 é um modelo de geração de texto desenvolvido pela OpenAI e disponível através da API da OrcaRouter. Faz parte da família GPT-3.5-Turbo, otimizado para tarefas…

O que é openai/gpt-3.5-turbo-0125?

Quem deve usar este modelo?

Como o OrcaRouter entrega este modelo?

Quais são as características de entrada/saída?

Exemplos de código

Chame de qualquer SDK

Compatível com OpenAI — mantenha seu SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-3.5-turbo-0125",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parâmetros suportados

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_tokens
  • presence_penalty
  • response_format
  • seed
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • parallel_tool_calls

Preços

Entrada / 1M tokens$0.500
Saída / 1M tokens$1.50
MoedaUSD

Calculadora de custos

Tokens / mês10MM
Proporção de entrada70%%
Estimado / mês $8.00

Estimativa com base no preço de tabela

Estimador de tokens e custo

Tokens de entrada: 15Custo por solicitação: $0.000758

Apenas uma estimativa — a contagem real de tokens depende do tokenizador do provedor.

Desempenho

p50 TTFT
3.64 s
Velocidade de saída
Coletando…
p95 TTFT
3.64 s
Taxa de erro
0%

Benchmarks públicos

10.7
AA Coding
Melhor que 2% dos modelos comparados
nº 118 de 123
3.6
AA Intelligence
Melhor que 0% dos modelos comparados
nº 122 de 125
GPQA Diamond
29.7
MATH-500
44.1
MMLU-Pro
46.2
Fonte: artificialanalysis.ai

Comparativo

openai/gpt-3.5-turbo-0125GPT-5.2 ProGPT-5.4 ProGPT-5.5
Entrada $/M$0.50$21.00$60.00$5.00
Saída $/M$1.50$168.00$270.00$30.00
Contexto400K1.1M
Qualidade2/1010/1010/1010/10
Comparar lado a ladoComparar lado a ladoComparar lado a ladoComparar lado a lado

FAQ

Qual é o custo para usar openai/gpt-3.5-turbo-0125 no OrcaRouter?
O preço é exatamente a taxa direta da OpenAI com markup zero: US$ 0,50 por 1 milhão de tokens de entrada e US$ 1,50 por 1 milhão de tokens de saída. Não há taxas adicionais.
Qual é o tamanho da janela de contexto?
O modelo suporta um contexto total de 16,385 tokens (entrada + saída), com saída limitada a 4096 tokens por geração. Esta é uma informação pública amplamente conhecida para esta versão do modelo.
Quais são os principais pontos fortes deste modelo?
Oferece um forte equilíbrio entre velocidade, custo e qualidade para tarefas de texto. Obtém 46,2 no MMLU-Pro e lida com instruções, chat e saídas estruturadas de forma confiável.
Como ele se compara ao GPT-4?
GPT-4 supera-o em raciocínio complexo, mas custa significativamente mais por token. Use GPT-3.5-Turbo-0125 para aplicações sensíveis a custo ou de alto volume onde a precisão próxima à do GPT-4 não é necessária.
O OrcaRouter registra ou armazena meus dados?
OrcaRouter processa requisições para a API da OpenAI. Ele não registra ou armazena prompts ou completions além do que é necessário para faturamento e segurança operacional. Consulte a política de privacidade da OpenAI para saber como seus dados são tratados.
Como faço para chamar este modelo usando uma API compatível com OpenAI?
Defina a URL base como https://api.orcarouter.ai/v1, o modelo como 'openai/gpt-3.5-turbo-0125', e use sua chave de API do OrcaRouter no cabeçalho Authorization. O formato padrão de conclusões de chat funciona.
Posso transmitir respostas em streaming?
Sim. Defina o parâmetro 'stream' como true na sua solicitação. As respostas serão enviadas como eventos enviados pelo servidor com deltas de token, seguindo o formato de streaming da OpenAI.
Qual é o comprimento máximo de saída?
O modelo pode gerar até 4096 tokens em uma única resposta. Use o parâmetro 'max_tokens' para controlar isso, mas ele não pode exceder 4096.
Este modelo é adequado para tarefas multilíngues?
Funciona em muitos idiomas, mas tem melhor desempenho em inglês. A precisão pode cair para idiomas com poucos recursos ou expressões idiomáticas complexas.

Incorporar este selo

openai/gpt-3.5-turbo-0125$0.50/M in3644ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg" alt="openai/gpt-3.5-turbo-0125 no OrcaRouter" /> </a>
Markdown [![openai/gpt-3.5-turbo-0125](https://www.orcarouter.ai/embed/openai/gpt-3.5-turbo-0125.svg)](https://www.orcarouter.ai/models/openai/gpt-3.5-turbo-0125)

Ficha do modelo como dados

GET /api/public/models/openai/gpt-3.5-turbo-0125Abrir
Legível por máquina:/llms.txt/llms-full.txt