GPT-4o-mini

openai/gpt-4o-mini
비전도구JSON
제공 OpenAI · 2024-07-18

GPT-4o 미니는 OpenAI의 최신 모델로, [GPT-4 옴니](/models/openai/gpt-4o) 이후에 출시되었으며 텍스트와 이미지 입력을 모두 지원하고 텍스트 출력을 제공합니다. 가장 진보된 소형 모델로서, 비용이 몇 배 더 저렴합니다...

컨텍스트128K 토큰
최대 출력16.4K
입력text + image + file
출력text
p50 TTFT4.23 s
입력$0.15/ 100만 토큰
출력$0.60/ 100만 토큰
p50 TTFT4.23 s7일
p95 TTFT10.00 s7일
트래픽9.6M토큰 / 7일

GPT-4o-mini는 OpenAI의 GPT-4o 모델의 더 작고 빠른 변형으로, 멀티모달 기능을 유지하면서 낮은 계산 비용에 최적화되었습니다. 텍스트, 이미지, 업로드된 파일을 입력으로 처리하고 텍스트 출력을 생성할 수 있습니다. 이 모델은 OpenAI에서 호스팅하며, 기본 URL https://api.orcarouter.ai/v1에서…

GPT-4o-mini는 무엇인가요?

누가 GPT-4o-mini를 사용하면 좋을까요?

모델 아키텍처는 GPT-4o와 어떻게 다른가요?

어떤 입력 방식을 지원하나요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

가격

입력 / 1M tokens$0.150
출력 / 1M tokens$0.600
캐시 읽기 / 1M$0.075
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $2.85 · 프롬프트 캐싱 사용 시 $2.59

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000301

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
4.23 s
출력 속도
870 tok/s
p95 TTFT
10.00 s
오류율
0.30%

공개 벤치마크

11.4
AA Coding
비교된 모델 중 7%보다 우수
123개 중 114위
6.9
AA Intelligence
비교된 모델 중 3%보다 우수
125개 중 119위
14.7
AA Math
비교된 모델 중 2%보다 우수
81개 중 78위
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
소스: artificialanalysis.ai

비교

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
입력 $/100만$0.15$21.00$60.00$5.00
출력 $/100만$0.60$168.00$270.00$30.00
컨텍스트128K400K1.1M
품질2/1010/1010/1010/10
나란히 비교나란히 비교나란히 비교나란히 비교

OpenAI의 다른 모델

FAQ

OrcaRouter를 통해 GPT-4o-mini를 사용하는 비용은 얼마인가요?
입력 토큰은 1M당 $0.15, 출력 토큰은 1M당 $0.60이며, OpenAI의 요금과 정확히 일치하며 마크업이 전혀 없습니다.
GPT-4o-mini의 컨텍스트 윈도우는 무엇인가요?
컨텍스트 창은 128,000 토큰이며, 최대 출력은 16,384 토큰입니다.
GPT-4o-mini의 주요 장점은 무엇인가요?
다양한 입력(텍스트, 이미지, 파일), 큰 컨텍스트 창, 빠른 추론, 낮은 비용을 결합하여 광범위한 작업을 수행합니다.
GPT-4o-mini는 GPT-4o와 어떻게 비교됩니까?
GPT-4o-mini는 토큰 가격이 약 94% 저렴하지만, 복잡한 추론과 창의적 생성에서는 정확도가 떨어질 수 있습니다. MATH-500에서 GPT-4o-mini는 78.9점을 기록한 반면, GPT-4o는 더 높은 점수를 받았습니다.
OrcaRouter가 내 프롬프트를 기록하거나 저장합니까?
OrcaRouter는 사용자의 프롬프트를 기록하거나 저장하지 않습니다; 모든 데이터는 OpenAI로 직접 전달됩니다. 해당 처리에 대해서는 OpenAI의 데이터 사용 정책을 참조하십시오.
어떻게 OrcaRouter의 API를 통해 GPT-4o-mini를 호출하나요?
OpenAI와 호환되는 엔드포인트 https://api.orcarouter.ai/v1 을 모델 ID "openai/gpt-4o-mini"와 함께 사용하세요. OrcaRouter API 키를 포함하세요.
GPT-4o-mini가 동일한 요청에서 텍스트와 이미지를 모두 처리할 수 있나요?
네, 128K 토큰 컨텍스트 내에서 텍스트, 이미지, 파일을 동시에 수용합니다.
GPT-4o-mini의 속도/지연 시간은 무엇인가요?
지연 시간은 일반적으로 낮습니다—적당한 프롬프트의 경우 첫 번째 토큰은 보통 1초 미만이지만 컨텍스트 길이와 API 부하에 따라 달라집니다. 스트리밍은 인지된 지연 시간을 줄입니다.

이 배지 임베드

OpenAI: GPT-4o-mini$0.15/M in4232ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OrcaRouter 의 OpenAI: GPT-4o-mini" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

모델 카드를 데이터로

GET /api/public/models/openai/gpt-4o-mini열기
기계 판독 가능:/llms.txt/llms-full.txt