GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
ראייהכליםJSON
מאת OpenAI · 2024-08-06

גרסת 2024-08-06 של GPT-4o מציעה ביצועים משופרים בפלטים מובנים, עם יכולת לספק סכימת JSON ב-respone_format. קרא עוד [כאן](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" עבור "omni") הוא...

הקשר128K tokens
מקסימום פלט16K
קלטtext + image + file
פלטtext
p50 TTFT700 ms
קלט$2.50/ 1M טוקנים
פלט$10.00/ 1M טוקנים
p50 TTFT700 ms7 ימים
p95 TTFT926 ms7 ימים
תעבורה196טוקנים / 7 ימים

GPT-4o (2024-08-06) הוא גרסה של המודל GPT-4o של OpenAI, ששוחררה באוגוסט 2024. זהו מודל שפה גדול מולטי-מודאלי המעבד תשומות טקסט, תמונה וקבצים. המודל נגיש דרך ממשק ה-API התואם ל-OpenAI של OrcaRouter,…

מה זה GPT-4o (2024-08-06)?

למי מיועד המודל הזה?

אילו אופני קלט הוא תומך?

מפרטים עיקריים במבט חטוף

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

תמחור

תמחור
קלט / 1M טוקנים$2.50
פלט / 1M tokens$10.00
קריאת מטמון / 1M$1.25
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $47.50 · עם מטמון הנחיות $43.13

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.005030

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
700 ms
מהירות פלט
10.1 tok/s
p95 TTFT
926 ms
שיעור שגיאות
12.5%

מבחני ביצועים ציבוריים

16.6
AA Coding
טוב יותר מ-11% מהמודלים שהושוו
#123 מתוך 138
7.7
AA Intelligence
טוב יותר מ-9% מהמודלים שהושוו
#128 מתוך 141
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.3
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
41.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
מקור: artificialanalysis.ai

באזז קהילתי

על מה מפתחים מדברים השבוע

Hacker News0 אזכורים · 7 ימים

איך זה משתווה

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
קלט $/מיליון$2.50$21.00$60.00$5.00
פלט $/מיליון$10.00$168.00$270.00$30.00
הקשר128K400K1.1M
איכות3/1010/1010/1010/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות לכל טוקן עבור GPT-4o (2024-08-06) ב-OrcaRouter?
התמחור הוא $2.50 לכל 1 מיליון טוקנים בקלט ו-$10.00 לכל 1 מיליון טוקנים בפלט, מחויב בתעריף הספק של OpenAI ללא תוספת תשלום מ-OrcaRouter. קלט של תמונות וקבצים כרוך בעלות טוקנים נוספת לפי המדיניות של OpenAI.
מהו חלון ההקשר והטוקנים המרביים בתפוקה?
חלון ההקשר הוא 128,000 אסימונים. הפלט המקסימלי הוא 16,384 אסימונים. זה מאפשר עיבוד של מסמכים או שיחות ארוכים ויצירת תגובות משמעותיות.
מה הן החוזקות העיקריות של המודל הזה?
היא מציעה יכולת חשיבה מתמטית חזקה (79.5 ב-MATH-500), קלט רב-מודאלי (טקסט, תמונות, קבצים), חלון הקשר רחב, ואיכות יצירה גבוהה של OpenAI. היא מתאימה במיוחד למשימות חשיבה מורכבות ומשימות חזותיות.
כיצד מודל זה משתווה למודל זול יותר כמו GPT-4o mini?
GPT-4o (2024-08-06) יקרה יותר אך בדרך כלל מסוגלת יותר במשימות חשיבה ורב-מודאליות. GPT-4o mini זולה יותר ($0.15/$0.60 ל-1M טוקנים) ומספיקה למשימות פשוטות. בחר בהתאם למורכבות המשימה ולתקציב.
אילו מדיניות טיפול בנתונים חלות?
הנתונים שלך נשלחים ל-OpenAI לעיבוד. OrcaRouter אינו מאחסן הנחיות. מדיניות השימוש בנתונים של OpenAI חלה. השתמש בניתוב רב-ספקים של OrcaRouter כדי להפנות בקשות לספקים העומדים בדרישות התאימות שלך.
האם אני יכול להשתמש במודל זה עם לקוח OpenAI Python?
כן, על ידי הגדרת כתובת הבסיס ל-https://api.orcarouter.ai/v1 ושימוש במזהה המודל "openai/gpt-4o-2024-08-06". הקוד הקיים שלך עבור ChatCompletion, streaming, ו-function calling עובד ללא שינויים.
איך שולחים קלטי תמונה דרך ה-API?
כלול את התמונה כמחרוזת מוצפנת ב-base64 או כקישור (URL) במערך התוכן של הודעה, תוך שימוש בפורמט "image_url" עם פרמטר detail. המודל מפרש תמונות לצורך ניתוח. פעולה זו עוקבת אחר פורמט ה-API הרב-מודאלי של OpenAI.
מהי התפוקה המקסימלית שניתן להפיק לכל בקשה?
הפלט המקסימלי הוא 16,384 אסימונים. השתמש בפרמטר max_tokens כדי לשלוט באורך התגובה. שים לב שפלטים ארוכים יותר מגדילים עלות וזמן השהייה.
האם הדגם הזה זמין לסטרימינג?
כן, בעת שימוש ב-API תואם OpenAI, ניתן להגדיר stream=True לקבלת תגובות בהדרגה. זה עובד עם נקודת הקצה של OrcaRouter.
האם אפשר להשתמש במודל הזה בחינם או בתקופת ניסיון?
המודל מחויב בתעריפי הספק. OrcaRouter עשויה להציע רמה חינמית או זיכויים לניסיון – בדוק באתר האינטרנט שלהם להצעות עדכניות. שימוש מעבר לזיכויים החינמיים כרוך בעלויות התעריף הסטנדרטי לכל אסימון.

הטמעת התג הזה

OpenAI: GPT-4o (2024-08-06)$2.50/M in700ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) ב-OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

כרטיס מודל כנתונים

GET /api/public/models/openai/gpt-4o-2024-08-06פתיחה
קריא למכונה:/llms.txt/llms-full.txt