GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06
ראייהכליםJSON
מאת OpenAI · 2024-08-06

גרסת 2024-08-06 של GPT-4o מציעה ביצועים משופרים בפלטים מובנים, עם יכולת לספק סכימת JSON ב-respone_format. קרא עוד [כאן](https://openai.com/index/introducing-structured-outputs-in-the-api/). GPT-4o ("o" עבור "omni") הוא...

הקשר128K tokens
מקסימום פלט16.4K
קלטtext + image + file
פלטtext
p50 TTFT2.00 s
קלט$2.50/ 1M טוקנים
פלט$10.00/ 1M טוקנים
p50 TTFT2.00 s7 ימים
p95 TTFT7.61 s7 ימים
תעבורה207.0Kטוקנים / 7 ימים

GPT-4o (2024-08-06) הוא גרסה של המודל GPT-4o של OpenAI, ששוחררה באוגוסט 2024. זהו מודל שפה גדול מולטי-מודאלי המעבד תשומות טקסט, תמונה וקבצים. המודל נגיש דרך ממשק ה-API התואם ל-OpenAI של OrcaRouter,…

מה זה GPT-4o (2024-08-06)?

למי מיועד המודל הזה?

אילו אופני קלט הוא תומך?

מפרטים עיקריים במבט חטוף

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-2024-08-06",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • frequency_penalty
  • logit_bias
  • logprobs
  • max_completion_tokens
  • max_tokens
  • n
  • parallel_tool_calls
  • prediction
  • presence_penalty
  • response_format
  • seed
  • service_tier
  • stop
  • stream
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • web_search_options

תמחור

קלט / 1M טוקנים$2.50
פלט / 1M tokens$10.00
קריאת מטמון / 1M$1.25
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $47.50 · עם מטמון הנחיות $43.13

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.005030

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
2.00 s
מהירות פלט
477 tok/s
p95 TTFT
7.61 s
שיעור שגיאות
0%

מבחני ביצועים ציבוריים

16.6
AA Coding
טוב יותר מ-12% מהמודלים שהושוו
#108 מתוך 123
9.6
AA Intelligence
טוב יותר מ-10% מהמודלים שהושוו
#110 מתוך 125
AIME
11.7
GPQA Diamond
52.1
Humanity's Last Exam
2.9
IFBench
36.0
LiveCodeBench
31.7
Long-Context Recall
35.0
MATH-500
79.5
SciCode
33.1
TerminalBench Hard
8.3
τ²-Bench
28.9
מקור: artificialanalysis.ai

איך זה משתווה

GPT-4o (2024-08-06)GPT-5.2 ProGPT-5.4 ProGPT-5.5
קלט $/מיליון$2.50$21.00$60.00$5.00
פלט $/מיליון$10.00$168.00$270.00$30.00
הקשר128K400K1.1M
איכות3/1010/1010/1010/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות לכל טוקן עבור GPT-4o (2024-08-06) ב-OrcaRouter?
התמחור הוא $2.50 לכל 1 מיליון טוקנים בקלט ו-$10.00 לכל 1 מיליון טוקנים בפלט, מחויב בתעריף הספק של OpenAI ללא תוספת תשלום מ-OrcaRouter. קלט של תמונות וקבצים כרוך בעלות טוקנים נוספת לפי המדיניות של OpenAI.
מהו חלון ההקשר והטוקנים המרביים בתפוקה?
חלון ההקשר הוא 128,000 אסימונים. הפלט המקסימלי הוא 16,384 אסימונים. זה מאפשר עיבוד של מסמכים או שיחות ארוכים ויצירת תגובות משמעותיות.
מה הן החוזקות העיקריות של המודל הזה?
היא מציעה יכולת חשיבה מתמטית חזקה (79.5 ב-MATH-500), קלט רב-מודאלי (טקסט, תמונות, קבצים), חלון הקשר רחב, ואיכות יצירה גבוהה של OpenAI. היא מתאימה במיוחד למשימות חשיבה מורכבות ומשימות חזותיות.
כיצד מודל זה משתווה למודל זול יותר כמו GPT-4o mini?
GPT-4o (2024-08-06) יקרה יותר אך בדרך כלל מסוגלת יותר במשימות חשיבה ורב-מודאליות. GPT-4o mini זולה יותר ($0.15/$0.60 ל-1M טוקנים) ומספיקה למשימות פשוטות. בחר בהתאם למורכבות המשימה ולתקציב.
אילו מדיניות טיפול בנתונים חלות?
הנתונים שלך נשלחים ל-OpenAI לעיבוד. OrcaRouter אינו מאחסן הנחיות. מדיניות השימוש בנתונים של OpenAI חלה. השתמש בניתוב רב-ספקים של OrcaRouter כדי להפנות בקשות לספקים העומדים בדרישות התאימות שלך.
האם אני יכול להשתמש במודל זה עם לקוח OpenAI Python?
כן, על ידי הגדרת כתובת הבסיס ל-https://api.orcarouter.ai/v1 ושימוש במזהה המודל "openai/gpt-4o-2024-08-06". הקוד הקיים שלך עבור ChatCompletion, streaming, ו-function calling עובד ללא שינויים.
איך שולחים קלטי תמונה דרך ה-API?
כלול את התמונה כמחרוזת מוצפנת ב-base64 או כקישור (URL) במערך התוכן של הודעה, תוך שימוש בפורמט "image_url" עם פרמטר detail. המודל מפרש תמונות לצורך ניתוח. פעולה זו עוקבת אחר פורמט ה-API הרב-מודאלי של OpenAI.
מהי התפוקה המקסימלית שניתן להפיק לכל בקשה?
הפלט המקסימלי הוא 16,384 אסימונים. השתמש בפרמטר max_tokens כדי לשלוט באורך התגובה. שים לב שפלטים ארוכים יותר מגדילים עלות וזמן השהייה.
האם הדגם הזה זמין לסטרימינג?
כן, בעת שימוש ב-API תואם OpenAI, ניתן להגדיר stream=True לקבלת תגובות בהדרגה. זה עובד עם נקודת הקצה של OrcaRouter.
האם אפשר להשתמש במודל הזה בחינם או בתקופת ניסיון?
המודל מחויב בתעריפי הספק. OrcaRouter עשויה להציע רמה חינמית או זיכויים לניסיון – בדוק באתר האינטרנט שלהם להצעות עדכניות. שימוש מעבר לזיכויים החינמיים כרוך בעלויות התעריף הסטנדרטי לכל אסימון.

הטמעת התג הזה

OpenAI: GPT-4o (2024-08-06)$2.50/M in2000ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg" alt="OpenAI: GPT-4o (2024-08-06) ב-OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o (2024-08-06)](https://www.orcarouter.ai/embed/openai/gpt-4o-2024-08-06.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-2024-08-06)

כרטיס מודל כנתונים

GET /api/public/models/openai/gpt-4o-2024-08-06פתיחה
קריא למכונה:/llms.txt/llms-full.txt