GPT-4o ("o" اختصار لـ "omni") هو أحدث نموذج ذكاء اصطناعي من OpenAI، يدعم كلاً من المدخلات النصية والصورية مع مخرجات نصية. يحافظ على مستوى ذكاء [GPT-4 Turbo](/models/openai/gpt-4-turbo) بينما يكون ضعف...
GPT-4o هو نموذج لغوي كبير متعدد الوسائط من OpenAI. يقبل إدخالات النص والصور والملفات، ويخرج نصوصًا. صُمم النموذج للمستخدمين الذين يحتاجون إلى معالجة محتوى طويل (حتى 128,000 رمز) ويحتاجون إلى قدرات…
يتفوق GPT-4o في التفكير متعدد الوسائط، ومعالجة السياقات الطويلة، وحل المشكلات الرياضية. يسمح له سياقه الذي يبلغ 128 ألف رمز (128k-token) بالاحتفاظ بكميات كبيرة من المعلومات والإشارة إليها، مما يجعله مفيدًا لمهام مثل تحليل المستندات، وتوليد الأكواد عبر المشاريع بأكملها، والمحادثات المعقدة متعددة الأدوار. سجل النموذج 75.9 على معيار MATH-500، مما يشير إلى قدرة قوية على حل المشكلات الرياضية. بالإضافة إلى ذلك، فإن قدرته على قبول مدخلات الصور والملفات تعني أنه يمكنه التفكير في المحتوى البصري—مثل الرسوم البيانية والمخططات أو الصور الفوتوغرافية—بالاشتراك مع النص. على منصة OrcaRouter، يمكنك الاستفادة من هذه القوى دون دفع أي رسوم إضافية فوق أسعار OpenAI المعلنة.
GPT-4o فعال للغاية في المهام التي تتطلب فهماً نصياً وبصرياً. تشمل الأمثلة: الإجابة عن الأسئلة حول رسم بياني في كتاب مدرسي، استخراج البيانات من فاتورة ممسوحة ضوئياً، إنشاء كود بناءً على صورة إطار سلكي، أو تلخيص ورقة بحثية طويلة تحتوي على أشكال. كما أن سياقه الكبير يجعله مناسباً لتحليل قواعد الكود بأكملها أو سجلات المحادثات الطويلة. الاستدلال الرياضي هو نقطة قوة أخرى، كما يتضح من نتيجته 75.9 في MATH-500. على OrcaRouter، هذه الحالات الاستخدامية سهلة التنفيذ - حيث ترسل طلباً قياسياً متوافقاً مع OpenAI مع أنواع المحتوى المناسبة، ويعيد النموذج استجابة نصية.
إذا كانت مهمتك لا تتطلب إدخالاً متعدد الوسائط أو سياقًا كبيرًا، فقد يكون النموذج الأرخص أكثر فعالية من حيث التكلفة. على سبيل المثال، بالنسبة لمهام تصنيف النصوص البسيطة أو التلخيص أو الترجمة التي تتناسب مع سياق أصغر، فإن نماذج مثل GPT-3.5 Turbo (بسعر $0.50 لكل 1 مليون إدخال و $1.50 لكل 1 مليون إخراج) هي أرخص بكثير. تكلفة إدخال GPT-4o هي $2.50 لكل 1 مليون رمز، وهو ما يعادل خمسة أضعاف تكلفة GPT-3.5 Turbo. إذا كنت تعالج كميات كبيرة من البيانات النصية فقط دون الحاجة إلى استدلال متعدد الوسائط، يمكن لنموذج أصغر أن يقلل التكاليف. تقدم OrcaRouter مجموعة متنوعة من النماذج حتى تتمكن من اختيار أفضل توازن بين السعر والأداء.
تم تصميم GPT-4o لقبول الصور والملفات كمدخلات، مما يمكنه من أداء مهام مثل الإجابة على الأسئلة البصرية، ووصف الصور، وفهم المستندات. على الرغم من عدم توفير نتائج محددة لمعايير التقييم متعددة الوسائط في الحقائق المتاحة، إلا أن بنية النموذج تدعم التفكير المشترك في النصوص والصور. على سبيل المثال، يمكنه عد الأشياء في صورة أو تفسير رسم بياني. ينتج النموذج نصوصًا فقط، وليس صورًا. على منصة OrcaRouter، يتم إرسال الطلبات متعددة الوسائط باستخدام نفس المعلمات المستخدمة في واجهة OpenAI: قم بتضمين image_url أو جزء محتوى الملف في مصفوفة messages. يقوم النموذج بمعالجة البيانات المرئية وإرجاع استجابة نصية بناءً على الإدخال المُدمج.
يحقق GPT-4o درجة 75.9 على معيار MATH-500. MATH-500 هي مجموعة فرعية من مجموعة بيانات MATH، والتي تتكون من 500 مسألة رياضية صعبة عبر مواضيع مختلفة مثل الجبر والهندسة وحساب التفاضل والتكامل. درجة 75.9 تعني أن النموذج يحل حوالي 76% من هذه المسائل بشكل صحيح. يشير هذا إلى قدرة قوية على التفكير الرياضي، وإن لم تكن مثالية. للمقارنة، العديد من النماذج الأصغر تحصل على درجات أقل من 50 على معايير مماثلة. هذه الدرجة تعكس قدرة النموذج على أداء التفكير متعدد الخطوات والتعامل مع الرموز الرياضية. على OrcaRouter، يمكنك استخدام GPT-4o للمهام المتعلقة بالرياضيات مثل التدريس أو التحضير للاختبارات أو التحقق من الحسابات.
مثل جميع نماذج اللغة الكبيرة، فإن GPT-4o له حدود. قد يُنتج إجابات غير صحيحة أو مُختلقة، خاصة في المواضيع ذات البيانات التدريبية المحدودة أو التي تتطلب معرفة حديثة جدًا (تاريخ قطع المعرفة الخاص به غير مذكور في الحقائق، ولكن بصفته نموذجًا من OpenAI، لديه قطع معرفة). يمكن أن يكون حساسًا لصياغة الاستفسارات وقد يواجه صعوبة مع التعليمات الغامضة. على الرغم من درجته العالية في MATH-500، إلا أنه ليس معصومًا من الخطأ في البراهين الرياضية المعقدة. النموذج يعالج الصور ولكنه لا يُنشئها. بالإضافة إلى ذلك، يمكن أن تؤدي نافذة السياق الكبيرة (128 ألف رمز) إلى زيادة استخدام الرموز، مما يرفع التكاليف إذا لم تُدار بحذر. على OrcaRouter، يمكنك تخفيف بعض المشكلات عن طريق ضبط معلمات مثل درجة الحرارة و top_p.
أرقام زمن الاستجابة الدقيقة لـ GPT-4o غير مذكورة في الحقائق. بشكل عام، GPT-4o نموذج كبير وسيكون له زمن استجابة أعلى مقارنة بالنماذج الأصغر مثل GPT-3.5 Turbo أو Llama 3.1 8B. ومع ذلك، من المحتمل أن يكون محسّنًا للاستدلال الأسرع من GPT-4 الأصلي. عبر OrcaRouter، يمكنك توقع أوقات استجابة مماثلة لتلك التي ستحصل عليها مباشرة من OpenAI، حيث يقوم النظام الأساسي بتوجيه الطلبات دون معالجة إضافية. بالنسبة للتطبيقات في الوقت الفعلي حيث تكون السرعة أمرًا بالغ الأهمية، فكّر في استخدام نموذج أسرع وأرخص للمهام الأبسط، واحتفظ بـ GPT-4o للاستعلامات المعقدة التي تستفيد من قدراته.
على OrcaRouter، يتم تسعير GPT-4o وفقًا لأسعار OpenAI المعلنة تمامًا: 2.50 دولار لكل مليون توكن إدخال و10.00 دولار لكل مليون توكن إخراج. لا توجد أي زيادة من OrcaRouter. يتم الفوترة بناءً على عدد التوكنات مقربة إلى أقرب توكن كامل. تشمل توكنات الإدخال النصوص والصور والملفات التي ترسلها، على الرغم من أن الصور تُحوَّل عادةً إلى توكنات بمعدل ثابت من قبل النموذج (على سبيل المثال، تستهلك كل صورة عددًا معينًا من التوكنات). توكنات الإخراج هي النصوص التي يُنشئها النموذج. أنت تُدفع فقط مقابل ما تستخدمه؛ لا توجد رسوم شهرية أو حد أدنى للالتزام. تسمح لك هذه التسعيرة الشفافة بتخطيط الميزانية بدقة لأعباء عملك في الذكاء الاصطناعي.
المقايضة الأساسية هي التكلفة مقابل القدرة. تكلفة GPT-4o هي $2.50 للإدخال و $10 للإخراج لكل مليون رمز. النماذج الأرخص مثل GPT-3.5 Turbo ($0.50 للإدخال، $1.50 للإخراج) أو Llama 3.1 8B أكثر اقتصادية للمهام البسيطة أو ذات الحجم الكبير. ومع ذلك، فإن GPT-4o يوفر إدخالاً متعدد الوسائط ونافذة سياق أكبر. إذا كان تطبيقك يتطلب فهم الصور أو معالجة مستندات طويلة جدًا، فقد يكون GPT-4o ضروريًا على الرغم من التكلفة الأعلى. بالنسبة للمهام النصية فقط ذات المدخلات القصيرة، يمكن لنموذج أرخص توفير المال. على OrcaRouter، يمكنك التبديل بين النماذج بتغيير بسيط في معرف النموذج، لذا يمكنك تحسين التكلفة لكل طلب.
لا. تفرض OrcaRouter رسومًا على GPT-4o بسعر المزود تمامًا دون أي زيادة. الأسعار هي $2.50 لكل مليون رمز إدخال و$10.00 لكل مليون رمز إخراج. لا توجد رسوم خفية أو عروض بيع إضافية أو رسوم إضافية. تقوم OrcaRouter بتمرير التكلفة مباشرة من OpenAI. تنطبق هذه السياسة على جميع النماذج المدرجة في المنصة. عنوان URL الأساسي هو https://api.orcarouter.ai/v1 ومعرف النموذج هو "openai/gpt-4o". يمكنك التحقق من الأسعار في أي وقت عن طريق مراجعة لوحة الاستخدام الخاصة بك. لا توجد أسعار متدرجة أو التزام مطلوب—ادفع فقط مقابل الرموز المستهلكة.
لاستخدام GPT-4o عبر OrcaRouter، أرسل طلبات HTTP POST إلى عنوان URL الأساسي https://api.orcarouter.ai/v1/chat/completions. عيّن معامل النموذج إلى "openai/gpt-4o". يجب أن يتضمن طلبك مفتاح API (قدّم مفتاح OrcaRouter API الخاص بك في عنوان التفويض Authorization). يتبع نص الطلب تنسيق مكالمات الدردشة القياسي من OpenAI: مصفوفة messages تحتوي على أزواج role/content، ومعاملات اختيارية مثل temperature وmax_tokens وtop_p وغيرها. بالنسبة للمدخلات متعددة الوسائط، قم بتضمين أجزاء محتوى من نوع "text" أو "image_url" (أو file). الرد هو كائن JSON يحتوي على إكمال النموذج. مثال على أمر curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -H "Content-Type: application/json" -d '{"model":"openai/gpt-4o","messages":[{"role":"user","content":[{"type":"text","text":"What is in this image?"},{"type":"image_url","image_url":{"url":"https://example.com/image.jpg"}}]}]}'
عند الاتصال بـ GPT-4o عبر OrcaRouter، يمكنك استخدام نفس المعاملات المتاحة في واجهة OpenAI. من المعاملات الشائعة: - temperature (float، 0-2): يتحكم في العشوائية. القيم المنخفضة مثل 0.2 تجعل المخرجات أكثر حتمية. - max_tokens (عدد صحيح، الافتراضي 16384): الحد الأقصى لعدد التوكنات في الاستجابة. - top_p (float، 0-1): معامل أخذ العينات النووية. - frequency_penalty و presence_penalty: تقليل التكرار. - stop (سلسلة نصية أو مصفوفة): تسلسلات التوقف. - stream (قيمة منطقية): تفعيل الاستجابات المتدفقة (true/false). - seed (عدد صحيح): لأخذ عينات حتمية. يمكنك أيضًا استخدام الحقل الاختياري "user" لتتبع المستخدمين الفرديين. يدعم النموذج استدعاء الدوال وأدوات الاستخدام، وإن لم تُذكر صراحةً في المعلومات. على OrcaRouter، جميع المعاملات القياسية مقبولة.
الترحيل مباشر لأن OrcaRouter يوفر نقطة نهاية متوافقة مع OpenAI. الخطوات: 1. احصل على مفتاح API من OrcaRouter (سجل في موقعهم الإلكتروني). 2. غيّر عنوان URL الأساسي من https://api.openai.com/v1 إلى https://api.orcarouter.ai/v1. 3. غيّر معرف النموذج من "gpt-4o" إلى "openai/gpt-4o". 4. استخدم نفس تنسيق جسم الطلب. لا حاجة لتغييرات في الشيفرة بخلاف نقطة النهاية واسم النموذج. 5. حدّث رأس Authorization لاستخدام مفتاح API الخاص بـ OrcaRouter. يوصى بإجراء اختبار بطلب واحد. يستخدم OrcaRouter نفس أوضاع البث (streaming) وعدم البث (non-streaming). لا يوجد فرق في سلوك النموذج، لأنه نفس نموذج OpenAI الأساسي. ستعمل مطالباتك ومعاملاتك الحالية بالطريقة نفسها.
رابط الأساس لـ API الخاص بـ OrcaRouter هو https://api.orcarouter.ai/v1. معرف النموذج المحدد لاستخدامه مع GPT-4o هو "openai/gpt-4o". يجب تمرير هذه السلسلة النصية بالضبط في معامل "model" الخاص بالطلب. على سبيل المثال، في استدعاء نقطة نهاية إكمال الدردشة، تقوم بتعيين "model": "openai/gpt-4o". يدعم OrcaRouter هذا النموذج لكل من الإكمالات المتدفقة وغير المتدفقة. إذا كنت تستخدم SDK أو مكتبة من OpenAI تم تكوينها للإشارة إلى رابط أساس مخصص، فما عليك سوى تعيين الرابط الأساسي إلى https://api.orcarouter.ai/v1 وتقديم مفتاح API الخاص بـ OrcaRouter الخاص بك. البادئة "openai/" لمعرف النموذج تميزه عن نماذج المزودين الآخرين على OrcaRouter.
GPT-4o هو الخليفة متعدد الوسائط لـ GPT-4 Turbo. كلا النموذجين لهما نافذة سياقية بسعة 128 ألف رمز. ومع ذلك، يضيف GPT-4o دعمًا أصليًا لإدخال الصور والملفات، بينما كان GPT-4 Turbo نصيًا بشكل أساسي (مع توفر الرؤية فقط في إصدارات منفصلة). كما أن GPT-4o لديه حد أقصى للإخراج يبلغ 16,384 رمزًا مقارنة بـ 4,096 أو 8,192 نموذجية لـ GPT-4 Turbo. تختلف الأسعار: تبلغ تكلفة GPT-4 Turbo 10.00 دولارًا لكل مليون رمز إدخال و 30.00 دولارًا لكل مليون رمز إخراج، مما يجعل GPT-4o أرخص بكثير (2.50 دولارًا / 10.00 دولارًا). درجة MATH-500 البالغة 75.9 لـ GPT-4o أعلى بشكل عام من المعايير المبلغ عنها لـ GPT-4 Turbo، على الرغم من أن درجات Turbo الدقيقة ليست في الحقائق. على OrcaRouter، كلا النموذجين متاحان بدون رسوم إضافية.
GPT-3.5 Turbo هو نموذج أرخص وأسرع مُحسَّن للمهام البسيطة. يبلغ طول نافذة السياق فيه 16,384 رمزًا (token)، وهو أصغر بكثير من 128k في GPT-4o. لا يدعم GPT-3.5 إدخال الصور—فهو نصي فقط. سعره هو $0.50 لكل 1M من رموز الإدخال و $1.50 لكل 1M من رموز الإخراج، مما يجعله أرخص بحوالي 5 مرات للإدخالات و 6.6 مرات للمخرجات مقارنة بـ GPT-4o. في اختبار MATH-500، يسجل GPT-3.5 Turbo عادةً درجات أقل بكثير (لم يتم تقديم أرقام دقيقة). GPT-4o أكثر ملاءمة للاستدلال المعقد والمستندات الطويلة والمهام متعددة الوسائط. استخدم GPT-3.5 Turbo للتفاعلات البسيطة ذات الحجم الكبير. على OrcaRouter، يمكنك التبديل بينهما بسهولة عن طريق تغيير معرف النموذج.
Claude 3.5 Sonnet هو نموذج منافس من شركة Anthropic. يتمتع أيضًا بنافذة سياقية تبلغ 200 ألف رمز (أكبر من 128 ألفًا في GPT-4o) ويدعم إدخال الصور. يبلغ سعر Claude 3.5 Sonnet عادةً 3.00 دولار لكل مليون رمز إدخال و15.00 دولار لكل مليون رمز مخرجات، مما يجعل GPT-4o أرخص في الإدخال ولكنه أغلى في الإخراج؟ في الواقع، سعر GPT-4o هو 2.50 دولار للإدخال مقابل 3.00 دولار، لذا فهو أرخص؛ والإخراج 10 دولارات مقابل 15 دولارًا، لذا أرخص. في الاختبارات المعيارية، يحقق Claude 3.5 Sonnet أداءً مشابهًا في الرياضيات والاستدلال المنطقي، لكن الدرجات الدقيقة تختلف. كلا النموذجين قويان في المهام متعددة الوسائط. قد يعتمد الاختيار بينهما على خصائص أداء محددة أو تفضيلات النظام البيئي. على OrcaRouter، يمكن الوصول إلى كليهما عبر نفس تنسيق API مع معرفات نموذج مختلفة (مثل "anthropic/claude-3.5-sonnet").
Llama 3.1 405B هو نموذج مفتوح الأوزان من Meta يضم 405 مليار معلمة. كما يدعم نافذة سياق بحجم 128 ألف رمز وإدخال نصي، لكن قدراته متعددة الوسائط أقل وضوحًا (قد لا يدعم الصور بشكل أصلي). يتوفر Llama 3.1 405B عبر OrcaRouter بسعر أقل، عادةً حوالي 1.00 دولار لكل مليون رمز إدخال و1.00 دولار لكل مليون رمز إخراج (تقريبي، غير مذكور في الحقائق). لم تُعطَ نتائجه في اختبار MATH-500 لكنها على الأرجح أقل من نتيجة GPT-4o البالغة 75.9. GPT-4o هو نموذج مملوك خاص ويقدم قدرات استدلال متعددة الوسائط جاهزة أفضل وربما دقة أعلى في المهام المعقدة. Llama 3.1 405B هو خيار جيد للمستخدمين الذين يريدون نموذجًا مفتوحًا أو يحتاجون إلى استضافته ذاتيًا. على OrcaRouter، يمكنك مقارنة كلا النموذجين جنبًا إلى جنب.
متوافق مع OpenAI — أبقِ على SDK الحالي
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| الإدخال / 1M توكن | $2.50 |
| الإخراج / 1M توكن | $10.00 |
| قراءة الذاكرة المؤقتة / 1M | $1.25 |
| العملة | USD |
تقدير بناءً على السعر المُعلن
تقدير فقط — يعتمد العدد الفعلي للرموز على مُجزّئ الرموز الخاص بالمزوّد.
GET /api/public/models/openai/gpt-4oفتح @misc{orcarouter_gpt_4o,
title = {GPT-4o API},
author = {OpenAI},
year = {2024},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o}
}OpenAI. (2024). GPT-4o API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o