GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
WizjaNarzędziaJSON
przez OpenAI · 2024-08-06

Wersja GPT-4o z 2024-08-06 oferuje lepszą wydajność w zakresie ustrukturyzowanych wyników, z możliwością dostarczenia schematu JSON w respone_format. Czytaj więcej [tutaj](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" jak "omni") to...

kont.128K tokenów
Maks. wyjście16.4K
Wejścietext + image + file
Wyjścietext
p50 TTFT2.00 s
WEJŚCIE$2.50/ 1M tokenów
WYJŚCIE$10.00/ 1M tokenów
p50 TTFT2.00 s7 d
p95 TTFT7.61 s7 d
RUCH207.0Ktokenów / 7 d

GPT-4o (2024-08-06) to wersja modelu GPT-4o od OpenAI, wydana w sierpniu 2024 roku. Jest to wielomodalny duży model językowy, który przetwarza dane wejściowe w postaci tekstu, obrazów i plików. Model…

Co to jest GPT-4o (2024-08-06)?

Dla kogo jest ten model?

Jakie tryby wprowadzania obsługuje?

Kluczowe specyfikacje w skrócie

Przykłady kodu

Wywołuj z dowolnego SDK

Zgodne z OpenAI — zostań przy swoim SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Obsługiwane parametry

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Cennik

Wejście / 1M tokenów$2.50
Wyjście / 1M tokenów$10.00
Odczyt cache / 1M$1.25
WalutaUSD

Kalkulator kosztów

Tokeny / miesiąc10MM
Udział wejścia70%%
Szacunkowo / miesiąc $47.50 · Z cache promptów $43.13

Szacunek na podstawie cennika

Kalkulator tokenów i kosztów

Tokeny wejściowe: 19Koszt na żądanie: $0.005047

Tylko szacunek — rzeczywista liczba tokenów zależy od tokenizatora dostawcy.

Wydajność

p50 TTFT
2.00 s
Prędkość wyjścia
477 tok/s
p95 TTFT
7.61 s
Wskaźnik błędów
0%

Publiczne benchmarki

16.6
AA Coding
Lepszy niż 12% porównywanych modeli
108 z 123
9.6
AA Intelligence
Lepszy niż 10% porównywanych modeli
110 z 125
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.9
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
35.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
Źródło: artificialanalysis.ai

Porównanie

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Wejście $/M$2.50$21.00$60.00$5.00
Wyjście $/M$10.00$168.00$270.00$30.00
Kontekst128K400K1.1M
Jakość3/1010/1010/1010/10
Porównaj obok siebiePorównaj obok siebiePorównaj obok siebiePorównaj obok siebie

FAQ

Jaki jest koszt za token dla GPT-4o (2024-08-06) na OrcaRouter?
Ceny wynoszą 2,50 USD za 1 milion tokenów wejściowych i 10,00 USD za 1 milion tokenów wyjściowych, rozliczane według stawki dostawcy OpenAI z zerową marżą ze strony OrcaRouter. Wejścia obrazów i plików wiążą się z dodatkowymi kosztami tokenów zgodnie z polityką OpenAI.
Czym jest okno kontekstowe i maksymalna liczba tokenów wyjściowych?
Okno kontekstu wynosi 128 000 tokenów. Maksymalne wyjście to 16 384 tokenów. Pozwala to na przetwarzanie długich dokumentów lub rozmów oraz generowanie obszernych odpowiedzi.
Jakie są główne mocne strony tego modelu?
Oferuje silne matematyczne rozumowanie (79.5 na MATH-500), multimodalne wejście (tekst, obrazy, pliki), duże okno kontekstu oraz generowanie wysokiej jakości od OpenAI. Jest dobrze przystosowane do złożonych zadań rozumowania i wizji.
Jak ten model wypada w porównaniu z tańszym modelem, takim jak GPT-4o mini?
GPT-4o (2024-08-06) jest droższy, ale ogólnie bardziej zdolny w zakresie rozumowania i zadań multimodalnych. GPT-4o mini jest tańszy ($0,15/$0,60 za 1 mln tokenów) i wystarczający do prostych zadań. Wybierz w zależności od złożoności zadania i budżetu.
Jakie polityki przetwarzania danych mają zastosowanie?
Twoje dane są wysyłane do OpenAI w celu przetworzenia. OrcaRouter nie przechowuje promptów. Obowiązują polityki wykorzystania danych OpenAI's. Użyj routingu wielodostawcy OrcaRouter's, aby kierować żądania do dostawców spełniających Twoje wymagania dotyczące zgodności.
Czy mogę użyć tego modelu z OpenAI Python client?
Tak, ustawiając podstawowy URL na https://api.orcarouter.ai/v1 i używając identyfikatora modelu "openai/gpt-4o-2024-08-06". Twój istniejący kod dla ChatCompletion, strumieniowania i wywoływania funkcji działa bez zmian.
Jak wysłać obrazy jako dane wejściowe przez API?
Dołącz obraz jako zakodowany w base64 ciąg znaków lub URL w tablicy content wiadomości, używając formatu "image_url" z parametrem detail. Model interpretuje obrazy w celu analizy. Jest to zgodne z formatem multimodalnego API OpenAI.
Jaka jest maksymalna ilość wyników generowanych na żądanie?
Maksymalna długość odpowiedzi wynosi 16 384 tokeny. Użyj parametru max_tokens, aby kontrolować długość odpowiedzi. Pamiętaj, że dłuższe odpowiedzi zwiększają koszt i opóźnienie.
Czy ten model jest dostępny do streamingu?
Tak, podczas korzystania z API kompatybilnego z OpenAI, możesz ustawić stream=True, aby otrzymywać odpowiedzi przyrostowo. Działa to z punktem końcowym OrcaRouter.
Czy mogę używać tego modelu za darmo lub w ramach wersji próbnej?
Model jest rozliczany według stawek dostawcy. OrcaRouter może oferować darmowy poziom lub kredyty próbne — sprawdź ich stronę internetową, aby poznać aktualne oferty. Użytkowanie przekraczające jakiekolwiek darmowe kredyty wiąże się ze standardowymi kosztami za token.

Osadź tę odznakę

OpenAI: GPT-4o (2024-08-06)$2.50/M in2000ms p50przez OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) w OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

Karta modelu jako dane

GET /api/public/models/openai/gpt-4o-2024-08-06Otwórz
Odczyt maszynowy:/llms.txt/llms-full.txt