GPT-4o-mini

openai/gpt-4o-mini
VisioneStrumentiJSON
di OpenAI · 2024-07-18

GPT-4o mini è il modello più recente di OpenAI dopo [GPT-4 Omni](/models/openai/gpt-4o), che supporta input sia di testo che di immagini con output di testo. Come loro modello piccolo più avanzato, è molte volte più conveniente...

ctx128K token
Output max16.4K
Inputtext + image + file
Outputtext
p50 TTFT4.23 s
INGRESSO$0.15/ 1M token
USCITA$0.60/ 1M token
p50 TTFT4.23 s7 g
p95 TTFT10.00 s7 g
TRAFFICO9.6Mtoken / 7 g

GPT-4o-mini è una variante più piccola e veloce del modello GPT-4o di OpenAI, ottimizzata per ridurre i costi computazionali pur mantenendo le capacità multimodali. Può elaborare testo, immagini e…

Che cos'è GPT-4o-mini?

Chi dovrebbe usare GPT-4o-mini?

Come si differenzia l'architettura del modello da GPT-4o?

Quali modalità di input sono supportate?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Prezzi

Input / 1M token$0.150
Output / 1M token$0.600
Lettura cache / 1M$0.075
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $2.85 · Con cache dei prompt $2.59

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000303

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
4.23 s
Velocità di output
870 tok/s
p95 TTFT
10.00 s
Tasso di errore
0.30%

Benchmark pubblici

11.4
AA Coding
Migliore del 7% dei modelli confrontati
n. 114 su 123
6.9
AA Intelligence
Migliore del 3% dei modelli confrontati
n. 119 su 125
14.7
AA Math
Migliore del 2% dei modelli confrontati
n. 78 su 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Fonte: artificialanalysis.ai

A confronto

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Input $/M$0.15$21.00$60.00$5.00
Output $/M$0.60$168.00$270.00$30.00
Contesto128K400K1.1M
Qualità2/1010/1010/1010/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Qual è il costo per utilizzare GPT-4o-mini tramite OrcaRouter?
Il costo dei token di input è di $0.15 per 1M, il costo dei token di output è di $0.60 per 1M, corrispondendo esattamente alle tariffe di OpenAI con zero markup.
Qual è la finestra di contesto di GPT-4o-mini?
La finestra di contesto è 128,000 token e l'output massimo è 16,384 token.
Quali sono i principali punti di forza di GPT-4o-mini?
Combina input multimodali (testo, immagini, file), un'ampia finestra di contesto, inferenza veloce e basso costo per un'ampia gamma di attività.
Come si confronta GPT-4o-mini con GPT-4o?
GPT-4o-mini è circa il 94% più economico sul prezzo dei token, ma potrebbe essere meno accurato nel ragionamento complesso e nella generazione creativa. Su MATH-500, ottiene 78.9 rispetto al punteggio più alto di GPT-4o.
OrcaRouter registra o conserva i miei prompt?
OrcaRouter non registra né memorizza i tuoi prompt; tutti i dati vengono trasmessi a OpenAI. Fai riferimento all'informativa sull'uso dei dati di OpenAI per la loro gestione.
Come faccio a chiamare GPT-4o-mini tramite OrcaRouter's API?
Utilizza l'endpoint compatibile con OpenAI all'indirizzo https://api.orcarouter.ai/v1 con il modello "openai/gpt-4o-mini". Includi la tua chiave API di OrcaRouter.
GPT-4o-mini può elaborare sia testo che immagini nella stessa richiesta?
Sì, accetta testo, immagini e file contemporaneamente all'interno del contesto di 128K token.
Qual è la velocità/latenza di GPT-4o-mini?
La latenza è generalmente bassa—il primo token è solitamente inferiore a un secondo per prompt moderati—ma varia in base alla lunghezza del contesto e al carico dell'API. Lo streaming riduce la latenza percepita.

Incorpora questo badge

OpenAI: GPT-4o-mini$0.15/M in4232ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini su OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Scheda del modello come dati

GET /api/public/models/openai/gpt-4o-miniApri
Leggibile dalle macchine:/llms.txt/llms-full.txt