النسخة المؤرخة 2024-11-20 من GPT-4o تقدم قدرة متطورة على الكتابة الإبداعية مع كتابة أكثر طبيعية وجاذبية ومخصصة لتحسين الملاءمة وسهولة القراءة. كما أنها أفضل في العمل مع الملفات المرفوعة...
OpenAI GPT-4o (2024-11-20) هو نموذج لغوي متعدد الوسائط كبير طورته OpenAI. يقبل المدخلات في شكل نصوص وصور وملفات، وينتج مخرجات نصية. يدعم النموذج نافذة سياقية تبلغ 128,000 رمز (token) ويمكنه إنتاج ما…
GPT-4o يتفوق في المهام التي تتطلب تفكيرًا عميقًا، خاصة في الرياضيات (كما تشير درجته 75.9 في اختبار MATH-500). يؤدي أداءً جيدًا في الإجابة عن الأسئلة المعقدة، وتوليد الأكواد البرمجية، وتحليل البيانات. يدعم التعددية الوسائطية مما يمكنه من تفسير الصور والرسوم البيانية والمستندات، مما يجعله قويًا في تطبيقات مثل استخراج الجداول من ملفات PDF أو شرح الأشكال. نافذة السياق الكبيرة تجعله فعالاً في مهام مثل تلخيص النصوص الطويلة، والحفاظ على تماسك المحادثات متعددة الأدوار، ومعالجة مستودعات الأكواد البرمجية بأكملها. كما يتعامل بشكل موثوق مع اتباع التعليمات وإخراج البيانات المنظمة. بالنسبة للمهام الأبسط أو عالية التكرار، قد يكون النموذج الأقل تكلفة أكثر فعالية من حيث التكلفة.
بينما يقدم GPT-4o أداءً قويًا، فإن المهام الأبسط أو ذات الحجم الأكبر قد تُخدم بشكل أفضل بواسطة نموذج أرخص، مثل GPT-4o mini أو خيارات خفيفة أخرى. إذا كانت استفساراتك قصيرة، ولا تتطلب إدخال صور أو ملفات، ولديها تعقيد استدلالي منخفض، يمكن لنموذج أقل تكلفة أن يقلل التكاليف بشكل كبير. بالإضافة إلى ذلك، إذا كان زمن الاستجابة حرجًا، فإن النماذج الأصغر تستجيب عادةً بشكل أسرع. بالنسبة للمهام التي تتناسب مع نافذة سياق أصغر (مثلاً أقل من 8 آلاف رمز)، فإن استخدام نموذج بسعر أقل لكل رمز يمكن أن يكون أكثر اقتصادًا. قيّم المقايضة: تكلفة GPT-4o هي 2.50 دولار لكل مليون إدخال و10 دولارات لكل مليون إخراج، ولكن هناك العديد من البدائل الأرخص على OrcaRouter يمكنها التعامل مع الطلبات المباشرة بجزء بسيط من السعر.
يدعم GPT-4o الملفات كوسيط إدخال، مما يسمح للمستخدمين برفع الملفات (مثل PDF، ملفات نصية) ليتمكن النموذج من قراءتها ومعالجتها. يتم تحويل محتوى الملف إلى رموز (tokens) وإدراجه في نافذة السياق. يتيح ذلك أداء مهام مثل استخراج معلومات محددة من مستند، أو تلخيص محتواه، أو الإجابة عن أسئلة حوله. تعمل معالجة الملفات جنبًا إلى جنب مع إدخالات النص والصور، بحيث يمكن لطلب واحد أن يشمل مزيجًا منها. لاحظ أن رفع الملفات يستهلك سعة الرموز من نافذة السياق البالغة 128,000 رمز، لذا قد تؤدي الملفات الكبيرة إلى تقليل المساحة المتاحة للإدخال أو الإخراج الآخر. تقبل واجهة برمجة التطبيقات الخاصة بـ OrcaRouter رفع الملفات كجزء من تنسيق الطلب القياسي المتوافق مع OpenAI.
على الرغم من نقاط قوته، إلا أن GPT-4o له حدود. فقد يظل يهلوس في الاستفسارات الواقعية وينتج معلومات غير صحيحة، خاصة في المواضيع المتخصصة أو الحديثة. تفكيره الرياضي، رغم قوته (75.9 على MATH-500)، ليس مثاليًا وقد يفشل في المشكلات المعقدة متعددة الخطوات. النموذج غير مناسب لتطبيقات البث المباشر التي تتطلب زمن استجابة منخفض، حيث أن النماذج الأكبر عمومًا لها أوقات استدلال أطول. لا يدعم إدخال الصوت بشكل أصلي؛ يجب نسخ الصوت أولاً. أيضًا، نافذة السياق 128K مشتركة بين الإدخال والإخراج، لذا فإن المدخلات الطويلة جدًا تحد من طول الاستجابة. يعني حد معرفة النموذج (2024-11-20) أنه لا يمكنه توفير معلومات محدثة بعد ذلك التاريخ دون تعزيز الاسترجاع.
GPT-4o (2024-11-20) سجل 75.9 في معيار MATH-500، الذي يقيم التفكير الرياضي على مجموعة من 500 مسألة صعبة على مستوى المنافسات. تشير هذه النتيجة إلى النسبة المئوية للمسائل التي تم حلها بشكل صحيح. نتيجة 75.9 تضعه بين النماذج الرائدة في التفكير الرياضي، رغم أنها ليست الأعلى الممكنة. يختبر المعيار الجبر والهندسة والتفاضل والتكامل ومواضيع أخرى. يجب على المستخدمين تفسير هذه النتيجة كمقياس لقدرة النموذج على إجراء تفكير معقد متعدد الخطوات في سياق رياضي. وهي لا تدل على الأداء في مهام أخرى مثل الكتابة الإبداعية أو استرجاع الحقائق. مقارنة هذه النتيجة مع نماذج أخرى على OrcaRouter يمكن أن يساعد في اختيار النموذج المناسب للتطبيقات كثيفة الرياضيات.
يعتمد زمن الانتظار لـ GPT-4o على عوامل مثل حجم الطلب وطول المخرجات والتحميل المتزامن على بنية OpenAI التحتية. وباعتباره نموذجًا كبيرًا بسعة سياق 128 ألف ومدخلات متعددة الوسائط، فإن أوقات الاستدلال تكون عمومًا أعلى من النماذج الأصغر. يجب أن يتوقع المستخدمون أوقات استجابة في نطاق عدة ثوانٍ للمخرجات متوسطة الطول. بالنسبة للتطبيقات في الوقت الفعلي، قد تكون النماذج الأصغر على OrcaRouter أكثر ملاءمة. لا تُقدَّم أرقام دقيقة لزمن الانتظار في حقائق النموذج، لكن يُوصى بإجراء اختبارات تجريبية بأعباء عمل تمثيلية. يمكن أن يؤدي استخدام البث (streaming) إلى تقليل زمن الانتظار المدرَك من خلال تسليم الرموز أثناء توليدها. يدعم OrcaRouter البث عبر واجهة API المتوافقة مع OpenAI باستخدام المعامل 'stream: true'.
نقاط القوة الرئيسية: تفكير رياضي قوي (75.9 على MATH-500)، إدخال متعدد الوسائط (نص، صورة، ملف)، نافذة سياق كبيرة (128 ألف رمز)، حد إخراج مرتفع (16,384 رمز)، وتسعير تنافسي بمبلغ 2.50 دولار/10 دولار لكل مليون رمز. نقاط الضعف الصادقة: زمن الاستجابة أعلى من النماذج الأصغر؛ قد يهلوس في الاستفسارات الواقعية؛ لا يدعم الإدخال الصوتي؛ نافذة السياق المشتركة تتطلب تصميمًا دقيقًا للموجه؛ حد المعرفة هو 2024-11-20، لذا لا يمكنه الوصول إلى الأحداث الجارية. للمهام التي لا تتطلب تفكيرًا عميقًا، قد يوفر نموذج أرخص مثل GPT-4o mini استجابات أسرع وأكثر فعالية من حيث التكلفة. يجب على المستخدمين تقييم هذه المفاضلات مقابل حالة الاستخدام الخاصة بهم.
سعر GPT-4o هو 2.50 دولار لكل مليون رمز إدخال و10.00 دولارات لكل مليون رمز إخراج. هذه هي نفس الأسعار التي تفرضها OpenAI؛ لا تطبق OrcaRouter أي هامش ربح، لذا فأنت تدفع سعر المزود دون رسوم إضافية. تشمل رموز الإدخال جميع النصوص ورموز الصور ورموز الملفات في الاستعلام. رموز الإخراج هي الرد المُولَّد. على سبيل المثال، طلب يحتوي على 10,000 رمز إدخال و500 رمز إخراج يكلف (10,000/1,000,000)*2.50 + (500/1,000,000)*10.00 = 0.025 دولار + 0.005 دولار = 0.03 دولار. الفوترة تعتمد على الاستخدام بدون التزامات مسبقة. لا تضيف OrcaRouter أي رسوم خفية تتجاوز أسعار الرموز.
تسعير GPT-4o أعلى من النماذج الأصغر على OrcaRouter، مثل GPT-4o mini أو البدائل الخفيفة الأخرى. المقايضة هي أن GPT-4o يوفر قدرات استدلال فائقة وقدرات متعددة الوسائط للمهام التي تتطلبها. إذا كان تطبيقك يستخدم في الأساس نصوصًا قصيرة بدون صور، فقد يقلل نموذج أرخص التكاليف بنسبة 5-10x. ومع ذلك، بالنسبة للمهام التي تهم فيها نقاط قوة GPT-4o (e.g., complex math, document analysis)، قد تكون التكلفة الإضافية مبررة. بالإضافة إلى ذلك، نظرًا لأن GPT-4o لديه نافذة سياق كبيرة، فإن إدخال مدخلات طويلة جدًا يزيد من استهلاك الرموز والتكلفة. يُنصح بتقليل السياق غير الضروري واستخدام المطالبات الموجزة لإدارة النفقات.
التخزين المؤقت هو ميزة يمكنها تقليل التكاليف عند حدوث استفسارات متكررة أو مطابقات بادئة متكررة. قد يدعم OrcaRouter التخزين المؤقت لبعض المزودين، لكن سلوك التخزين المؤقت الخاص بـ GPT-4o غير مفصل في الحقائق المقدمة. يجب على المستخدمين استشارة وثائق OrcaRouter للتحقق من توفر التخزين المؤقت للإدخال وكيف يؤثر على الفوترة. عادةً، يتم فوترة الرموز المخزنة مؤقتًا بسعر أقل أو بدون فوترة. حتى بدون التخزين المؤقت، يضمن التسعير بدون هامش ربح أنك تدفع فقط السعر القياسي لـ OpenAI. بالنسبة للتطبيقات ذات الحجم الكبير، يمكن أن يوفر التخزين المؤقت توفيرًا كبيرًا؛ تحقق مع دعم OrcaRouter لتمكينه إذا كان مدعومًا.
يمرر OrcaRouter أسعار المزود لـ GPT-4o دون إضافة أي هامش ربح. وهذا يعني أنك تدفع بالضبط ما تفرضه OpenAI لكل رمز، دون أي رسوم إضافية على المنصة. قد يحقق OrcaRouter إيرادات عبر وسائل أخرى (مثلاً، الميزات المميزة، الخصومات على الحجم، أو خطط المؤسسات)، لكن سعر الواجهة الأساسي لـ GPT-4o هو بسعر المزود بشفافية. يعود هذا النموذج التسعيري بالنفع على المستخدمين الذين يريدون يقين التكلفة ونفقات قابلة للتوقع. لا توجد تكاليف خفية لاستخدام نقطة نهاية API المتوافقة مع OpenAI. تحقق دائمًا من أحدث الأسعار على موقع OrcaRouter الإلكتروني، حيث قد تتغير أسعار المزود.
لاستخدام GPT-4o على OrcaRouter، أرسل الطلبات إلى رابط الأساس https://api.orcarouter.ai/v1 مع معرف النموذج "openai/gpt-4o-2024-11-20". هذا الباب متوافق تمامًا مع واجهة OpenAI لمحادثات الإكمال. قم بتضمين بيانات المصادقة الخاصة بك (مفتاح API) وحدد النموذج. مثال باستخدام curl: ``` curl https://api.orcarouter.ai/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer YOUR_API_KEY" \ -d '{ "model": "openai/gpt-4o-2024-11-20", "messages": [{"role": "user", "content": "Hello"}] }' ``` ارجع إلى توثيق OrcaRouter للحصول على مرجع واجهة برمجة التطبيقات التفصيلي.
يدعم نص الطلب الخاص بـ GPT-4o معلمات إكمال الدردشة القياسية من OpenAI: model, messages, temperature, top_p, n, stream, stop, max_tokens, presence_penalty, frequency_penalty, logit_bias, user، وغيرها. يجب تعيين معلمة model إلى "openai/gpt-4o-2024-11-20". للإدخالات متعددة الوسائط، قم بتضمين رسائل مع content كمصفوفة من الأجزاء (text, image_url, file). تتطلب إدخالات الصور عنوان URL للبيانات أو عنوان URL. يمكن تقديم إدخالات الملفات كعنوان URL للملف أو محتوى مشفر بـ base64 (يعتمد التنسيق على تنفيذ OrcaRouter). يمكن ضبط max_tokens حتى 16384. استخدم stream: true للاستجابات المتدفقة. راجع وثائق OrcaRouter لأي معلمات أو تفاصيل إضافية.
يتطلب الانتقال من واجهة OpenAI المباشرة إلى OrcaRouter تغيير عنوان URL الأساسي ومعرف النموذج. قم بتحديث نقطة النهاية الخاصة بك من https://api.openai.com/v1 إلى https://api.orcarouter.ai/v1 واستبدل اسم النموذج بـ "openai/gpt-4o-2024-11-20". قد تختلف طريقة المصادقة: احصل على مفتاح API من OrcaRouter واستخدمه في رأس Authorization. تبقى جميع معاملات الطلب كما هي (رسائل، درجة الحرارة، إلخ). بالنسبة للكود الموجود، ما عليك سوى تغيير عنوان URL الأساسي وسلسلة النموذج. تدّعي OrcaRouter عدم وجود أي رسوم إضافية، لذا يجب أن ترى نفس التسعير على مستوى الرمز المميز. اختبر أولاً بطلب صغير لتأكيد السلوك والفواتير.
نعم، يدعم OrcaRouter البث المباشر لـ GPT-4o عبر واجهة برمجة التطبيقات المتوافقة مع OpenAI. قم بتعيين معامل stream إلى true في طلبك. سيرسل الخادم الرموز المميزة (tokens) أثناء توليدها باستخدام تنسيق أحداث الخادم المُرسَلة (SSE)، بما يتوافق مع واجهة البث المباشر من OpenAI. البث مفيد لتقليل زمن الاستجابة الظاهر في تطبيقات الدردشة ولعرض المخرجات بشكل تدريجي. مثال: تضمين "stream": true في جسم الطلب. سيكون الرد عبارة عن دفق من كائنات JSON بالتنسيق القياسي. لاحظ أن البث قد يزيد من إجمالي وقت الطلب قليلاً ولكنه يُحسّن تجربة المستخدم مع المخرجات الطويلة.
GPT-4o mini هو نموذج أصغر وأرخص، مصمم للمهام الأبسط. GPT-4o (2024-11-20) لديه نافذة سياق أكبر (128K مقابل 128K؟ في الواقع، GPT-4o mini لديه أيضًا سياق 128K، لكن ذلك غير مقدم؛ كن حذرًا. في الواقع سياق GPT-4o mini هو أيضًا 128K؟ هذا معروف على نطاق واسع لكن ليس لدينا حقائق. سأتجنب الأرقام التفصيلية. بدلاً من ذلك: GPT-4o مسعّر بأعلى (2.50$/10$ لكل مليون رمز) من GPT-4o mini (الأرخص). GPT-4o يقدم استدلالًا أعمق وأداءً أفضل في المعايير مثل MATH-500. للمهام التي تتطلب فهمًا معقدًا متعدد الوسائط، يُفضل GPT-4o. للمهام عالية الحجم ومنخفضة التعقيد (مثل التصنيف، الأسئلة والأجوبة البسيطة)، يوفر GPT-4o mini استدلالًا أسرع وتكلفة أقل. اختر بناءً على المفاضلة بين القدرة والميزانية.
GPT-4 Turbo هو نموذج سابق مع نافذة سياقية بحجم 128 ألف رمز وحدود إخراج مماثلة. GPT-4o (2024-11-20) بشكل عام أكثر فعالية من حيث التكلفة، مع أسعار رمز إدخال وإخراج أقل (2.50 دولار / 10 دولارات مقابل 10 دولارات / 30 دولارًا لـ Turbo لكل مليون رمز، لكن هذه الأرقام غير متوفرة؛ لا ينبغي لي اختلاقها. سأذكر: GPT-4o له سعر أقل لكل رمز من GPT-4 Turbo، وهو نموذج أحدث. قد تكون المعايير مثل MATH-500 (75.9 لـ GPT-4o) أعلى من معايير GPT-4 Turbo، على الرغم من أن النتائج الدقيقة غير متوفرة هنا. يدعم GPT-4o أيضًا إدخال الملفات بشكل أصلي. يجب على المستخدمين مقارنة الأداء المحدد في مهامهم الخاصة لاتخاذ القرار. تقدم OrcaRouter كلا النموذجين، لذا فإن التبديل سهل.
نماذج المصدر المفتوح (مثل Llama 3 وMistral) غالباً ما تعمل على بنيتك التحتية الخاصة وتتجنب التكاليف لكل رمز مميز (per-token) ولكنها تتطلب موارد حاسوبية. يوفر GPT-4o قدرات استدلال متطورة ومتعددة الوسائط (multimodal) بشكل جاهز، دون الحاجة إلى إدارة بنية تحتية. تكلفته (2.50 دولار/10 دولارات لكل مليون رمز مميز) قابلة للتوقع وتنافسية للاستخدام منخفض الحجم ولكنها قد تصبح باهظة الثمن على نطاق واسع. قد تكون نماذج المصدر المفتوح أقل زمن استجابة إذا تم استضافتها ذاتياً ويمكن أن تكون أرخص للأحجام الكبيرة. ومع ذلك، قد تتأخر في أداء المعايير (benchmarks) ودعم الوسائط المتعددة. يعتمد الاختيار على متطلبات التحكم لديك، وميزانيتك، والحاجة إلى أداء متطور. يوفر OrcaRouter الوصول إلى كل من النماذج الخاصة والمفتوحة.
متوافق مع OpenAI — أبقِ على SDK الحالي
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-2024-11-20",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| الإدخال / 1M توكن | $2.50 |
| الإخراج / 1M توكن | $10.00 |
| قراءة الذاكرة المؤقتة / 1M | $1.25 |
| العملة | USD |
تقدير بناءً على السعر المُعلن
تقدير فقط — يعتمد العدد الفعلي للرموز على مُجزّئ الرموز الخاص بالمزوّد.
GET /api/public/models/openai/gpt-4o-2024-11-20فتح @misc{orcarouter_gpt_4o_2024_11_20,
title = {GPT-4o (2024-11-20) API},
author = {OpenAI},
year = {2024},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-2024-11-20}
}OpenAI. (2024). GPT-4o (2024-11-20) API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-2024-11-20