GPT-4o-mini

openai/gpt-4o-mini
Thị giácCông cụJSON
bởi OpenAI · 2024-07-18

GPT-4o mini là mô hình mới nhất của OpenAI sau [GPT-4 Omni](/models/openai/gpt-4o), hỗ trợ cả đầu vào văn bản và hình ảnh với đầu ra văn bản. Là mô hình nhỏ tiên tiến nhất của họ, nó có giá phải chăng hơn nhiều lần...

ngữ cảnh128K token
Đầu ra tối đa16.4K
Đầu vàotext + image + file
Đầu ratext
TTFT p504.23 s
ĐẦU VÀO$0.15/ 1M token
ĐẦU RA$0.60/ 1M token
TTFT p504.23 s7 ngày
p95 TTFT10.00 s7 ngày
LƯU LƯỢNG9.6Mtokens / 7 ngày

GPT-4o-mini là biến thể nhỏ hơn, nhanh hơn của mô hình GPT-4o của OpenAI, được tối ưu hóa để giảm chi phí tính toán trong khi vẫn giữ lại khả năng đa phương thức. Mô hình này có thể xử lý văn bản,…

GPT-4o-mini là gì?

Những ai nên sử dụng GPT-4o-mini?

Kiến trúc mô hình khác biệt như thế nào so với GPT-4o?

Những phương thức nhập liệu nào được hỗ trợ?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Giá

Đầu vào / 1M tokens$0.150
Đầu ra / 1M tokens$0.600
Đọc cache / 1M$0.075
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $2.85 · Có cache prompt $2.59

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000303

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
4.23 s
Tốc độ đầu ra
870 tok/s
p95 TTFT
10.00 s
Tỷ lệ lỗi
0.30%

Benchmark công khai

11.4
AA Coding
Tốt hơn 7% số mô hình được so sánh
#114 / 123
6.9
AA Intelligence
Tốt hơn 3% số mô hình được so sánh
#119 / 125
14.7
AA Math
Tốt hơn 2% số mô hình được so sánh
#78 / 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
Nguồn: artificialanalysis.ai

So sánh

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
Đầu vào $/M$0.15$21.00$60.00$5.00
Đầu ra $/M$0.60$168.00$270.00$30.00
Ngữ cảnh128K400K1.1M
Chất lượng2/1010/1010/1010/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí sử dụng GPT-4o-mini qua OrcaRouter là bao nhiêu?
Chi phí token đầu vào là $0.15 cho mỗi 1M, token đầu ra là $0.60 cho mỗi 1M, hoàn toàn khớp với mức giá của OpenAI mà không có bất kỳ phụ phí nào.
Cửa sổ ngữ cảnh của GPT-4o-mini là gì?
Cửa sổ ngữ cảnh là 128,000 token, và đầu ra tối đa là 16,384 token.
Các điểm mạnh chính của GPT-4o-mini là gì?
Nó kết hợp đầu vào đa phương thức (văn bản, hình ảnh, tệp tin), cửa sổ ngữ cảnh lớn, suy luận nhanh và chi phí thấp cho nhiều tác vụ.
GPT-4o-mini so sánh như thế nào với GPT-4o?
GPT-4o-mini rẻ hơn khoảng 94% về giá token nhưng có thể kém chính xác hơn trong suy luận phức tạp và sáng tạo. Trên MATH-500, nó đạt 78.9 so với điểm cao hơn của GPT-4o.
OrcaRouter có ghi lại hoặc lưu trữ các lời nhắc của tôi không?
OrcaRouter không ghi lại hoặc lưu trữ các prompt của bạn; tất cả dữ liệu được chuyển đến OpenAI. Tham khảo chính sách sử dụng dữ liệu của OpenAI để biết cách họ xử lý.
Làm thế nào để gọi GPT-4o-mini thông qua API của OrcaRouter?
Sử dụng điểm cuối tương thích OpenAI tại https://api.orcarouter.ai/v1 với model id "openai/gpt-4o-mini". Kèm theo khóa API OrcaRouter của bạn.
GPT-4o-mini có thể xử lý cả văn bản và hình ảnh trong cùng một yêu cầu không?
Có, nó chấp nhận văn bản, hình ảnh và tệp đồng thời trong ngữ cảnh 128K token.
Tốc độ/độ trễ của GPT-4o-mini là gì?
Độ trễ thường thấp—token đầu tiên thường dưới một giây đối với các prompt vừa phải—nhưng thay đổi tùy theo độ dài ngữ cảnh và tải API. Streaming giảm độ trễ cảm nhận.

Nhúng huy hiệu này

OpenAI: GPT-4o-mini$0.15/M in4232ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini trên OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/openai/gpt-4o-miniMở
Máy đọc được:/llms.txt/llms-full.txt