GPT-4o-mini

openai/gpt-4o-mini
ЗрениеИнструментыJSON
от OpenAI · 2024-07-18

GPT-4o mini — это новейшая модель OpenAI после [GPT-4 Omni](/models/openai/gpt-4o), поддерживающая как текстовые, так и графические входные данные с текстовыми выходами. Будучи их самой продвинутой малой моделью, она во много раз доступнее по цене...

конт.128K токенов
Макс. вывод16.4K
Вводtext + image + file
Выводtext
p50 TTFT4.23 s
ВХОД$0.15/ 1M токенов
ВЫХОД$0.60/ 1M токенов
p50 TTFT4.23 s7 д
p95 TTFT10.00 s7 д
ТРАФИК9.6Mтокенов / 7 д

GPT-4o-mini — это меньшая и более быстрая версия модели OpenAI GPT-4o, оптимизированная для снижения вычислительных затрат при сохранении мультимодальных возможностей. Она может обрабатывать текст,…

Что такое GPT-4o-mini?

Кому следует использовать GPT-4o-mini?

Чем архитектура модели отличается от GPT-4o?

Какие модальности ввода поддерживаются?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Цены

Ввод / 1M токенов$0.150
Вывод / 1M токенов$0.600
Чтение кэша / 1M$0.075
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $2.85 · С кэшем промптов $2.59

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000303

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
4.23 s
Скорость вывода
870 tok/s
p95 TTFT
10.00 s
Частота ошибок
0.30%

Публичные тесты

11.4
AA Coding
Лучше, чем 7% сравниваемых моделей
114 из 123
6.9
AA Intelligence
Лучше, чем 3% сравниваемых моделей
119 из 125
14.7
AA Math
Лучше, чем 2% сравниваемых моделей
78 из 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Источник: artificialanalysis.ai

Сравнение

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Ввод $/млн$0.15$21.00$60.00$5.00
Вывод $/млн$0.60$168.00$270.00$30.00
Контекст128K400K1.1M
Качество2/1010/1010/1010/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от OpenAI

FAQ

Сколько стоит использование GPT-4o-mini через OrcaRouter?
Входные токены стоят $0.15 за 1M, выходные токены стоят $0.60 за 1M, точно соответствуя тарифам OpenAI’s с нулевой наценкой.
Каков размер контекстного окна GPT-4o-mini?
Окно контекста составляет 128 000 токенов, а максимальный вывод — 16 384 токена.
Каковы основные сильные стороны GPT-4o-mini?
Он объединяет мультимодальный ввод (текст, изображения, файлы), большой контекстный окно, быструю инференцию и низкую стоимость для широкого круга задач.
Как GPT-4o-mini сравнивается с GPT-4o?
GPT-4o-mini примерно на 94% дешевле по цене токенов, но может быть менее точным в сложных рассуждениях и творческой генерации. На MATH-500 он набирает 78,9 против более высокого показателя GPT-4o.
Логгирует или сохраняет ли OrcaRouter мои запросы?
OrcaRouter не регистрирует и не сохраняет ваши запросы; все данные передаются в OpenAI. Обратитесь к политике использования данных OpenAI для получения информации об их обработке.
Как мне вызвать GPT-4o-mini через API OrcaRouter?
Используйте совместимую с OpenAI конечную точку по адресу https://api.orcarouter.ai/v1 с идентификатором модели "openai/gpt-4o-mini". Включите свой ключ API OrcaRouter.
Может ли GPT-4o-mini обрабатывать как текст, так и изображения в одном запросе?
Да, он принимает текст, изображения и файлы одновременно в контексте 128K токенов.
Какая скорость/задержка у GPT-4o-mini?
Задержка обычно низкая — первый токен, как правило, менее секунды для умеренных запросов — но варьируется в зависимости от длины контекста и нагрузки на API. Потоковая передача снижает воспринимаемую задержку.

Встроить значок

OpenAI: GPT-4o-mini$0.15/M in4232ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini в OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Карточка модели в виде данных

GET /api/public/models/openai/gpt-4o-miniОткрыть
Машиночитаемо:/llms.txt/llms-full.txt