GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
Thị giácCông cụJSON
bởi OpenAI · 2024-08-06

Phiên bản ngày 2024-08-06 của GPT-4o cung cấp hiệu suất cải thiện trong đầu ra có cấu trúc, với khả năng cung cấp một lược đồ JSON trong respone_format. Đọc thêm [tại đây](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" viết tắt của "omni") là...

ngữ cảnh128K token
Đầu ra tối đa16.4K
Đầu vàotext + image + file
Đầu ratext
TTFT p502.00 s
ĐẦU VÀO$2.50/ 1M token
ĐẦU RA$10.00/ 1M token
TTFT p502.00 s7 ngày
p95 TTFT7.61 s7 ngày
LƯU LƯỢNG207.0Ktokens / 7 ngày

GPT-4o (2024-08-06) là một phiên bản của mô hình GPT-4o của OpenAI, được phát hành vào tháng 8 năm 2024. Đây là một mô hình ngôn ngữ lớn đa phương thức có khả năng xử lý đầu vào văn bản, hình ảnh và…

GPT-4o (2024-08-06) là gì?

Mô hình này dành cho ai?

Nó hỗ trợ những phương thức đầu vào nào?

Tổng quan thông số kỹ thuật chính

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

Giá

Đầu vào / 1M tokens$2.50
Đầu ra / 1M tokens$10.00
Đọc cache / 1M$1.25
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $47.50 · Có cache prompt $43.13

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.005043

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
2.00 s
Tốc độ đầu ra
477 tok/s
p95 TTFT
7.61 s
Tỷ lệ lỗi
0%

Benchmark công khai

16.6
AA Coding
Tốt hơn 12% số mô hình được so sánh
#108 / 123
9.6
AA Intelligence
Tốt hơn 10% số mô hình được so sánh
#110 / 125
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.9
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
35.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
Nguồn: artificialanalysis.ai

So sánh

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
Đầu vào $/M$2.50$21.00$60.00$5.00
Đầu ra $/M$10.00$168.00$270.00$30.00
Ngữ cảnh128K400K1.1M
Chất lượng3/1010/1010/1010/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí cho mỗi token của GPT-4o (2024-08-06) trên OrcaRouter là bao nhiêu?
Giá cả là $2.50 cho mỗi 1 triệu token đầu vào và $10.00 cho mỗi 1 triệu token đầu ra, được tính theo giá của nhà cung cấp OpenAI với mức chênh lệch 0 từ OrcaRouter. Đầu vào hình ảnh và tệp tin sẽ phát sinh thêm chi phí token theo chính sách của OpenAI.
Context window và max output tokens là gì?
Cửa sổ ngữ cảnh là 128.000 token. Đầu ra tối đa là 16.384 token. Điều này cho phép xử lý các tài liệu hoặc cuộc hội thoại dài và tạo ra các phản hồi đáng kể.
Các điểm mạnh chính của mô hình này là gì?
Nó cung cấp khả năng suy luận toán học mạnh mẽ (79.5 trên MATH-500), đầu vào đa phương thức (văn bản, hình ảnh, tệp tin), cửa sổ ngữ cảnh lớn và khả năng sinh chất lượng cao của OpenAI. Nó rất phù hợp cho các tác vụ suy luận phức tạp và thị giác.
Mô hình này so sánh như thế nào với một mô hình rẻ hơn như GPT-4o mini?
GPT-4o (2024-08-06) đắt hơn nhưng thường có khả năng suy luận và đa phương thức tốt hơn. GPT-4o mini rẻ hơn ($0.15/$0.60 per 1M tokens) và đủ dùng cho các tác vụ đơn giản. Lựa chọn dựa trên độ phức tạp của tác vụ và ngân sách.
Các chính sách xử lý dữ liệu nào được áp dụng?
Dữ liệu của bạn được gửi đến OpenAI để xử lý. OrcaRouter không lưu trữ các prompt. Các chính sách sử dụng dữ liệu của OpenAI được áp dụng. Sử dụng tính năng định tuyến đa nhà cung cấp của OrcaRouter để hướng các yêu cầu đến các nhà cung cấp đáp ứng yêu cầu tuân thủ của bạn.
Tôi có thể sử dụng mô hình này với client Python của OpenAI không?
Có, bằng cách đặt base URL thành https://api.orcarouter.ai/v1 và sử dụng model ID "openai/gpt-4o-2024-08-06". Mã hiện có của bạn cho ChatCompletion, streaming và function calling hoạt động mà không cần thay đổi.
Làm thế nào để gửi đầu vào hình ảnh qua API?
Bao gồm hình ảnh dưới dạng chuỗi mã hóa base64 hoặc URL trong mảng nội dung của tin nhắn, sử dụng định dạng "image_url" với tham số detail. Mô hình diễn giải hình ảnh để phân tích. Điều này tuân theo định dạng API đa phương thức của OpenAI.
Đầu ra tối đa có thể được tạo ra mỗi yêu cầu là bao nhiêu?
Đầu ra tối đa là 16.384 token. Sử dụng tham số max_tokens để kiểm soát độ dài phản hồi. Lưu ý rằng đầu ra dài hơn sẽ làm tăng chi phí và độ trễ.
Mẫu này có sẵn để phát trực tuyến không?
Có, khi sử dụng API tương thích với OpenAI, bạn có thể đặt stream=True để nhận phản hồi dần dần. Điều này hoạt động với endpoint của OrcaRouter.
Tôi có thể sử dụng model này miễn phí hoặc dùng thử không?
Mô hình được tính phí theo tỷ lệ của nhà cung cấp. OrcaRouter có thể cung cấp gói miễn phí hoặc tín dụng dùng thử—hãy kiểm tra trang web của họ để biết các ưu đãi hiện tại. Sử dụng vượt quá bất kỳ tín dụng miễn phí nào sẽ phải chịu chi phí tiêu chuẩn cho mỗi token.

Nhúng huy hiệu này

OpenAI: GPT-4o (2024-08-06)$2.50/M in2000ms p50qua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) trên OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/openai/gpt-4o-2024-08-06Mở
Máy đọc được:/llms.txt/llms-full.txt