GPT-4o-mini

openai/gpt-4o-mini
การมองเห็นเครื่องมือJSON
โดย OpenAI · 2024-07-18

GPT-4o mini เป็นโมเดลใหม่ล่าสุดของ OpenAI หลังจาก [GPT-4 Omni](/models/openai/gpt-4o) ซึ่งรองรับทั้งอินพุตข้อความและรูปภาพพร้อมเอาต์พุตข้อความ ในฐานะที่เป็นโมเดลขนาดเล็กที่ล้ำหน้าที่สุดของพวกเขา มันมีราคาถูกกว่าหลายเท่า...

เอนด์พอยต์:/v1/chat/completions/v1/responses
ctx128K โทเค็น
เอาต์พุตสูงสุด16.4K
อินพุตtext + image + file
เอาต์พุตtext
p50 TTFT4.23 s
INPUT$0.15/ 1M โทเค็น
OUTPUT$0.60/ 1M โทเค็น
p50 TTFT4.23 s7 วัน
p95 TTFT10.00 s7 วัน
ทราฟฟิก9.6Mโทเค็น / 7วัน
รับ API ของ GPT-4o-mini ลองใน playground</> ใช้ผ่าน API

GPT-4o-mini เป็นโมเดลที่เล็กกว่าและเร็วกว่าของ OpenAI GPT-4o ซึ่งถูกปรับให้เหมาะสมสำหรับต้นทุนการคำนวณที่ต่ำลง ในขณะที่ยังคงความสามารถหลายรูปแบบ (multimodal) ไว้ สามารถประมวลผลข้อความ รูปภาพ…

GPT-4o-mini คืออะไร

ใครควรใช้ GPT-4o-mini?

สถาปัตยกรรมของโมเดลนี้แตกต่างจาก GPT-4o อย่างไร?

รองรับรูปแบบการป้อนข้อมูลใดบ้าง?

ตัวอย่างโค้ด

เรียกใช้จาก SDK ใดก็ได้

เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

พารามิเตอร์ที่รองรับ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

ราคา

อินพุต / 1M โทเค็น$0.150
เอาต์พุต / 1M โทเค็น$0.600
อ่านแคช / 1M$0.075
สกุลเงินUSD

เครื่องคำนวณค่าใช้จ่าย

โทเค็น / เดือน10MM
สัดส่วนอินพุต70%%
ประมาณ / เดือน $2.85 · เมื่อใช้แคชพรอมป์ต์ $2.59

ประมาณการจากราคาตั้ง

เครื่องมือประเมิน token และค่าใช้จ่าย

token อินพุต: 13ค่าใช้จ่ายต่อคำขอ: $0.000302

เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ

ประสิทธิภาพ

p50 TTFT
4.23 s
ความเร็วเอาต์พุต
870 tok/s
p95 TTFT
10.00 s
อัตราข้อผิดพลาด
0.30%

เกณฑ์มาตรฐานสาธารณะ

11.4
AA Coding
ดีกว่า 7% ของโมเดลที่เปรียบเทียบ
อันดับ 114 จาก 123
6.9
AA Intelligence
ดีกว่า 3% ของโมเดลที่เปรียบเทียบ
อันดับ 119 จาก 125
14.7
AA Math
ดีกว่า 2% ของโมเดลที่เปรียบเทียบ
อันดับ 78 จาก 81
AIME
11.7
AIME 2025
14.7
GPQA Diamond
42.6
Humanity's Last Exam
4.0
IFBench
31.0
LiveCodeBench
23.4
MATH-500
78.9
MMLU-Pro
64.8
SciCode
22.9
tau_banking
2.9
terminalbench_v2_1
5.6
แหล่งที่มา: artificialanalysis.ai

การเปรียบเทียบ

GPT-4o-miniGPT-5.2 ProGPT-5.4 ProGPT-5.5
อินพุต $/ล้าน$0.15$21.00$60.00$5.00
เอาต์พุต $/ล้าน$0.60$168.00$270.00$30.00
บริบท128K400K1.1M
คุณภาพ2/1010/1010/1010/10
เปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกันเปรียบเทียบแบบเคียงข้างกัน

เพิ่มเติมจาก OpenAI

FAQ

ค่าใช้จ่ายในการใช้ GPT-4o-mini ผ่าน OrcaRouter คือเท่าไหร่?
โทเคนอินพุตราคา $0.15 ต่อ 1M, โทเคนเอาต์พุตราคา $0.60 ต่อ 1M, ตรงกับอัตราของ OpenAI อย่างแม่นยำโดยไม่มีค่า markup ใดๆ
หน้าต่างบริบทของ GPT-4o-mini คืออะไร
หน้าต่างบริบทมีขนาด 128,000 โทเค็น และเอาต์พุตสูงสุดคือ 16,384 โทเค็น
อะไรคือจุดแข็งหลักของ GPT-4o-mini?
มันรวมการป้อนข้อมูลแบบหลายรูปแบบ (ข้อความ รูปภาพ ไฟล์) หน้าต่างบริบทขนาดใหญ่ การอนุมานที่รวดเร็ว และต้นทุนต่ำสำหรับงานที่หลากหลาย
GPT-4o-mini เปรียบเทียบกับ GPT-4o อย่างไร?
GPT-4o-mini มีราคาต่อโทเค็นถูกกว่าประมาณ 94% แต่อาจมีความแม่นยำน้อยกว่าในการใช้เหตุผลซับซ้อนและการสร้างสรรค์เชิงสร้างสรรค์ ใน MATH-500 ได้คะแนน 78.9 เทียบกับคะแนนที่สูงกว่าของ GPT-4o
OrcaRouter บันทึกหรือจัดเก็บข้อความแจ้งของฉันหรือไม่?
OrcaRouter ไม่ได้บันทึกหรือจัดเก็บ prompt ของคุณ; ข้อมูลทั้งหมดจะส่งต่อไปยัง OpenAI โปรดดูนโยบายการใช้งานข้อมูลของ OpenAI สำหรับการจัดการของพวกเขา
ฉันจะเรียก GPT-4o-mini ผ่าน API ของ OrcaRouter ได้อย่างไร?
ใช้ endpoint ที่เข้ากันได้กับ OpenAI ที่ https://api.orcarouter.ai/v1 โดยใช้รุ่นโมเดล "openai/gpt-4o-mini" รวมคีย์ API OrcaRouter ของคุณด้วย
GPT-4o-mini สามารถประมวลผลทั้งข้อความและรูปภาพในคำขอเดียวกันได้หรือไม่
ใช่, รองรับข้อความ, รูปภาพ, และไฟล์พร้อมกันภายในบริบทที่มี 128K token.
ความเร็ว/เวลาแฝงของ GPT-4o-mini คืออะไร?
ความหน่วงโดยทั่วไปอยู่ในระดับต่ำ—โทเค็นแรกมักจะต่ำกว่าหนึ่งวินาทีสำหรับพรอมต์ที่มีขนาดปานกลาง—แต่จะแตกต่างกันไปตามความยาวของบริบทและปริมาณการเรียกใช้ API การสตรีมช่วยลดความหน่วงที่รับรู้ได้

ฝังป้ายนี้

OpenAI: GPT-4o-mini$0.15/M in4232ms p50ผ่าน OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg" alt="OpenAI: GPT-4o-mini บน OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini](https://www.orcarouter.ai/embed/openai/gpt-4o-mini.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini)

ข้อมูลโมเดลแบบ data

GET /api/public/models/openai/gpt-4o-miniเปิด
อ่านได้ด้วยเครื่อง:/llms.txt/llms-full.txt