GPT-4o-mini

openai/gpt-4o-mini
WizjaNarzędziaJSON
przez OpenAI · 2024-07-18

GPT-4o mini to najnowszy model OpenAI po [GPT-4 Omni](/models/openai/gpt-4o), obsługujący zarówno tekst, jak i obrazy na wejściu z wyjściem tekstowym. Jako ich najbardziej zaawansowany mały model, jest wielokrotnie bardziej przystępny cenowo...

kont.128K tokenów
Maks. wyjście16.4K
Wejścietext + image + file
Wyjścietext
p50 TTFT4.23 s
WEJŚCIE$0.15/ 1M tokenów
WYJŚCIE$0.60/ 1M tokenów
p50 TTFT4.23 s7 d
p95 TTFT10.00 s7 d
RUCH9.6Mtokenów / 7 d

GPT-4o-mini to mniejszy, szybszy wariant modelu GPT-4o od OpenAI, zoptymalizowany pod kątem niższych kosztów obliczeniowych, zachowujący jednocześnie możliwości multimodalne. Może przetwarzać tekst,…

Czym jest GPT-4o-mini?

Kto powinien używać GPT-4o-mini?

Czym różni się architektura modelu od GPT-4o?

Jakie sposoby wprowadzania danych są obsługiwane?

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Cennik

Wejście / 1M tokenów$0.150
Wyjście / 1M tokenów$0.600
Odczyt cache / 1M$0.075
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $2.85 · Z cache promptów $2.59

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.000303

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
4.23 s
Prędkość wyjścia
870 tok/s
p95 TTFT
10.00 s
Wskaźnik błędów
0.30%

Publiczne benchmarki

11.4
AA Coding
Lepszy niż 7% porównywanych modeli
114 z 123
6.9
AA Intelligence
Lepszy niż 3% porównywanych modeli
119 z 125
14.7
AA Math
Lepszy niż 2% porównywanych modeli
78 z 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Źródło: artificialanalysis.ai

Porównanie

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Wejście $/M$0.15$21.00$60.00$5.00
Wyjście $/M$0.60$168.00$270.00$30.00
Kontekst128K400K1.1M
Jakość2/1010/1010/1010/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt korzystania z GPT-4o-mini przez OrcaRouter?
Tokeny wejściowe kosztują 0,15 USD za 1M, tokeny wyjściowe kosztują 0,60 USD za 1M, dokładnie odpowiadające stawkom OpenAI z zerową marżą.
Jakie jest okno kontekstowe modelu GPT-4o-mini?
Okno kontekstu wynosi 128,000 tokenów, a maksymalne wyjście to 16,384 tokenów.
Jakie są główne mocne strony GPT-4o-mini?
Łączy multimodalne dane wejściowe (tekst, obrazy, pliki), duże okno kontekstowe, szybkie wnioskowanie oraz niski koszt dla szerokiego zakresu zadań.
Jak GPT-4o-mini porównuje się z GPT-4o?
GPT-4o-mini jest o około 94% tańszy w cenniku tokenów, ale może być mniej dokładny w złożonym rozumowaniu i kreatywnym generowaniu. W teście MATH-500 uzyskuje wynik 78,9 wobec wyższego wyniku GPT-4o.
Czy OrcaRouter loguje lub przechowuje moje prompty?
OrcaRouter nie loguje ani nie przechowuje twoich zapytań; wszystkie dane są przekazywane do OpenAI. Zapoznaj się z polityką wykorzystania danych OpenAI, aby dowiedzieć się, jak są one obsługiwane.
Jak wywołać GPT-4o-mini przez API OrcaRoutera?
Użyj endpointu kompatybilnego z OpenAI pod adresem https://api.orcarouter.ai/v1 z identyfikatorem modelu "openai/gpt-4o-mini". Dołącz swój klucz API OrcaRouter.
Czy GPT-4o-mini może przetwarzać zarówno tekst, jak i obrazy w tym samym żądaniu?
Tak, akceptuje tekst, obrazy i pliki jednocześnie w kontekście 128K tokenów.
Jaka jest prędkość/opóźnienie GPT-4o-mini?
Opóźnienie jest zazwyczaj niskie – pierwszy token często poniżej jednej sekundy dla umiarkowanych promptów – ale różni się w zależności od długości kontekstu i obciążenia API. Strumieniowanie zmniejsza odczuwalne opóźnienie.

Osadź tę odznakę

OpenAI: GPT-4o-mini$0.15/M in4232ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini w OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Karta modelu jako dane

GET /api/public/models/openai/gpt-4o-miniOtwórz
Odczyt maszynowy:/llms.txt/llms-full.txt