
GPT-6 Astra API: معرّف النموذج، ونقطة النهاية، والتكلفة الفعلية لمهمة طويلة الأفق
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز
- deepseekجديدDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiجديدOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135الذكاء69البرمجة
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451الذكاء78البرمجة
The short version: GPT-6 Astra is callable today at https://api.openai.com/v1 under a single model id, gpt-6-astra, at $10.00 per million input tokens, $1.00 cached input and $50.00 output — the figures OpenAI's own pricing page carried on September 16, 2026. The model itself is from September 3, 2026, thirteen days before this page was written, so nothing here is launch coverage and nothing here is framed as an announcement. This is the reference page for the developer question that comes after availability: what string to pass, which endpoint takes it, what the 1,050,000-token window really buys, what the account has to look like first, and what one genuine long-horizon agent run costs on a rate card that quietly reprices itself above 272,000 input tokens. GPT-5.6 Sol appears throughout only as the price baseline it is sold above, never as the subject.
السبب في أن نموذجًا عمره ثلاثة عشر يومًا يستحق صفحة هذا الأسبوع هو أن طرق الوصول إليه تغيّرت بعد أن تغيّر الإطلاق، وأصبح مسار API الآن هو المسار العادي. عندما أطلقت OpenAI نموذج Astra في 3 سبتمبر، وصفت الأمر بأنه طرح تدريجي لا إتاحة؛ وبحلول 8 سبتمبر كانت تقول إن النموذج طُرح بالكامل لمستخدمي Plus وPro وBusiness وEnterprise في Codex وChatGPT Work، وبحلول أسبوع 14 سبتمبر كانت AWS تُدرجه على Bedrock، وكان Microsoft Foundry يوفره كمتاح عمومًا. بالنسبة لمن يستدعي API، ذلك التسلسل أقل أهمية مما يبدو — فقد ظلت نقطة النهاية نشطة وموثّقة طوال الوقت — لكنه يعني أن أسئلة التوريد المحيطة به أصبح لديها الآن إجابات لم تكن لديها يوم الإطلاق. كل ما ورد أدناه قُرئ من وثائق نموذج OpenAI الخاصة، وصفحة التسعير، وصفحة ضوابط البيانات في 16 سبتمبر 2026، وأي شيء يأتي من مصدر آخر يذكر ذلك في الجملة التي تتضمنه.
معرّف النموذج، وسؤال اللقطة الذي أُجيب عنه بصدق.
السلسلة التي يجب تمريرها هي gpt-6-astra — بحروف صغيرة، ومفصولة بشرطات، وبدون بادئة مورّد. هذا هو المعرّف الوحيد الذي توثّقه OpenAI لهذا النموذج.
إذا كنت تبحث عن لقطة مؤرخة لتثبيتها، فلا توجد واحدة يمكن العثور عليها، ولن نختلق لاحقة تبدو معقولة. تسرد صفحة OpenAI الخاصة بنموذج GPT-6 Astra مُدخلاً واحدًا فقط ضمن Snapshots، وهو gpt-6-astra المجرّد. لا يوجد -2026-09-03 على النمط المؤرخ ولا -latest اسم مستعار على جانب المورّد. لقد رأينا اسمًا مستعارًا متغيّرًا على شكل ~openai/gpt-astra-latest في قائمة أحد الموجّهات أثناء البحث؛ هذه بنية بوابة مبنية فوق معرّف المورّد، وليست شيئًا تنشره OpenAI، ولا ينبغي وضعه في إعداداتك كما لو كان كذلك.
النتيجة العملية صغيرة لكنها تستحق الذكر. يمكنك استرداد كائن النموذج للتأكد مما تتحدث إليه:
curl https://api.openai.com/v1/models/gpt-6-astra -H "Authorization: Bearer $OPENAI_API_KEY"
ثبّت المعرّف المجرّد في قيمة إعداد بدلًا من كتابته في دستة من مواضع الاستدعاء. إذا أضافت OpenAI لاحقًا لقطات مؤرخة، يصبح المعرّف المجرّد هدفًا متحركًا وتبدأ قيمتك المثبّتة تتغيّر تحت قدميك — فوجود مكان واحد للتعديل هو الفرق بين تغيير يستغرق دقيقتين وبين قضاء بعد الظهر في البحث باستخدام grep.
نقطة النهاية: عنوان URL الأساسي، والتوافق، وطلب يعمل
The base URL is https://api.openai.com/v1. Per OpenAI's model documentation, GPT-6 Astra is supported on Responses (/v1/responses), Chat Completions (/v1/chat/completions) and Batch (/v1/batch). It is explicitly not supported on Realtime, Assistants, Fine-tuning, Embeddings, image generation and editing, video, audio, moderation, or the legacy Completions endpoint — and those absences matter as much as the presence list, because a team that planned around the Assistants API or a fine-tuned variant has to replan rather than rewrite.
في شأن التوافق: هذه واجهة برمجة التطبيقات (API) الخاصة التي تطورها OpenAI نفسها، وهي تنسيق التبادل الذي كُتبت وفقًا له كل حزمة تطوير برمجيات (SDK) وكل عميل متوافق مع OpenAI. أي شيء يتحدث ذلك التنسيق سيتخاطب مع gpt-6-astra دون طبقة وسيطة — كل ما عليك فعله هو تغيير سلسلة النموذج، وإن كنت تنتقل من نموذج OpenAI أقدم، تغيير أسماء المعلمات الواردة أدناه. ينبغي أن يستخدم العمل الجديد واجهة Responses API: فهي السطح الذي توثّق عليه OpenAI التحكم في استدلال هذا النموذج، وفيها توجد الأدوات المدمجة، وقد كان دعم Chat Completions لأحدث النماذج تاريخيًا الأقل عمقًا بين الاثنين.
استدعاء بثّي بسيط للغاية، مع ضبط جهد الاستدلال:
curl https://api.openai.com/v1/responses \
-H "Authorization: Bearer $OPENAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "gpt-6-astra", "input": "اذكر الملفات التي ستغيّرها لنقل هذه الخدمة بعيدًا عن واجهة API الخاصة بالمصادقة القديمة.", "reasoning": {"effort": "high"}, "max_output_tokens": 16000, "stream": true}'
والأمر نفسه في بايثون، فهو المكان الذي سيقضي فيه معظم القراء وقتهم فعليًا:
from openai import OpenAI
client = OpenAI()
stream = client.responses.create(model="gpt-6-astra", input="اسرد الملفات التي ستغيّرها لنقل هذه الخدمة بعيدًا عن واجهة برمجة تطبيقات المصادقة القديمة.", reasoning={"effort": "high"}, max_output_tokens=16000, stream=True)
for event in stream:
if event.type == "response.output_text.delta": print(event.delta, end="")
ثلاثة أمور في ذلك الطلب خاصة بهذا النموذج تحديدًا، لا منسوخةً من دليل بدء سريع عام.
• جهد الاستدلال مِقبض تكلفة، وليس مقبض جودة فقط. تسرد صفحة نموذج OpenAI القيم المدعومة على أنها low وmedium وhigh وxhigh وmax. لاحظ من أين تبدأ تلك القائمة: لا يوجد none أو minimal في GPT-6 Astra، لذا ارتفع الحد الأدنى. تُحتسب رموز الاستدلال كرموز إخراج بسعر 50.00 دولارًا لكل مليون، وهو ما يعني أن تحويل الجهد من high إلى max قرار له ثمن، وليس ترقية جودة مجانية.
• البث مدعوم، وهو الطريقة الصادقة لتشغيل الجولات الطويلة. يمكن لطلب واحد على هذا النموذج أن يصدر ما يصل إلى 128,000 رمز إخراج. إن انتظار وصول ذلك في جسم استجابة واحد، دون أي رؤية لما إذا كان يتقدّم أم لا، هو ما يجعلك تنتهي إلى التخمين في المهلات الزمنية.
• التخزين المؤقت للمطالبات صريح هنا. توثق Responses API وجود prompt_cache_breakpoint على محتوى النص والصور والملفات، بوضع explicit، مما يحدد "النهاية الدقيقة لبادئة مطالبة قابلة لإعادة الاستخدام" ويرث مدة صلاحيته (TTL) من prompt_cache_options.ttl الخاص بالطلب. في نموذج يكون معدل الإدخال المخزن فيه عُشر معدل الإدخال غير المخزن، فإن المكان الذي تضع فيه هذا الحد هو السطر الأكثر تأثيرًا في طلبك.

ما الذي تعنيه فعليًا نافذة بحجم 1,050,000 رمز
الأرقام الموثّقة هي نافذة سياق بحجم 1,050,000 توكن، وحدّ أقصى للمدخلات يبلغ 922,000 توكن، وحدّ أقصى للمخرجات يبلغ 128,000 توكن، وتاريخ انتهاء المعرفة في 30 أبريل 2026.
ابدأ بالحساب الذي يفوته الناس: 922,000 زائد 128,000 يساوي 1,050,000. النافذة مشتركة بين ما ترسله وما قد يعيده النموذج، ويُحجز الحد الأقصى للمخرجات منها. لا يمكنك إرسال 1,050,000 رمز كمدخلات؛ فالحد العملي الأقصى لطلب واحد هو 922,000، وأقل من ذلك إذا أردت مساحة لإجابة حقيقية.
ماذا يشتري مليون توكن في الوحدات التي تعمل بها فعليًا؟ إن تحويلات التوكن إلى نص تقريبية، وهي تحويلاتنا لا تحويلات OpenAI، لكنها من الرتبة الصحيحة: عند نحو أربعة أحرف لكل توكن، فإن 1,050,000 توكن تكون في حدود 750,000 كلمة، أو شيء مثل مئة ألف سطر من الكود. هذا مستودع متوسط الحجم، كاملًا، مع مساحة متبقية لمخرجات الأدوات التي يولّدها الوكيل أثناء عمله. والحالة بعيدة المدى التي يُسوَّق النموذج من أجلها هي هذه بالتحديد: وكيل قرأ ملفًا قبل ساعة وما زال يستطيع رؤية ما جاء فيه، بدلًا من وكيل قام بضغط الصباح في فقرة ملخّص.
ثم الجزء الذي ينتمي إلى صفحة التكلفة وليس إلى صفحة المواصفات. توثيق نماذج OpenAI يذكر أن المطالبات التي تحتوي على أكثر من 272,000 توكن إدخال تُسعَّر بـضعف أسعار الإدخال والتخزين المؤقت و1.5 ضعف الإخراج للطلب بأكمله. وتعرضه صفحة الأسعار كصف ثانٍ: السياق الطويل على GPT-6 Astra هو 20.00 دولارًا للإدخال، و2.00 دولارًا للإدخال المخزَّن مؤقتًا، و75.00 دولارًا للإخراج. لذا فإن الأرباع الثلاثة العليا من تلك النافذة نطاق سعري، وليست مجرد سعة إضافية. أي تشغيل يتجاوز نصه 272,000 توكن يدفع ضعفَ الثمن على كل توكن إدخال — بما في ذلك المخزَّنة مؤقتًا — للطلب بأكمله، وهذا هو أكبر تقلّب منفرد في اقتصاديات هذا النموذج. وهو مشروح بالكامل أدناه.
ثمة آلية أخرى جديرة بالمعرفة، لأنها إقرار من المورّد نفسه بأن نافذة واحدة ليست الجواب الكامل. بالنسبة إلى Codex، تصف OpenAI نهج سياق تجريبيًا يُطرح مع Astra، تبقى فيه الملاحظات مستمرة عبر نوافذ السياق بدل الضغط المتكرر في ملخّص واحد، مع بقاء النوافذ الأسبق قابلة للبحث بحيث تظل المتطلبات ونتائج الاختبارات من الرسائل الأسبق ومخرجات الأدوات قابلة للعثور عليها. تسمّيه OpenAI تجريبيًا، وتقول إنه مُفعّل في Codex config.toml، وإنه سيصبح الإعداد الافتراضي لـ Astra. إذا كنت تبني المكافئ بنفسك على API، فهذا هو الشكل الذي ينبغي نسخه: ملاحظات دائمة بالإضافة إلى سجل قابل للاسترجاع، بدلًا من مطالبة واحدة بطولية.
وحدّ الرقم نفسه: النافذة الكبيرة سعة، وليست ضمانًا للانتباه عبرها. وتُعد أرقام الأفق الطويل التي يبلّغ عنها المورّدون دليلًا أفضل على السلوك من عدد الرموز — إذ تبلّغ OpenAI عن OSWorld 2.0 بنسبة 72.6% عند نحو 40 دقيقة لكل مهمة، وعن Terminal-Bench 4.0 بنسبة 57.9% مقابل 37.3% لـ GPT-5.6 Sol. هذه أرقام OpenAI نفسها، ولم نُعِد إنتاجها، والصورة المستقلة قريبة لكنها ليست مطابقة: قاست Artificial Analysis أداء Astra عند 59.1% على Terminal-Bench v4.0 مقابل 52.0% لـ Claude Fable 5.1 و39.9% لـ GPT-5.6 Sol. وكلاهما يتفق على أن فجوة الأفق الطويل مقارنةً بالجيل السابق حقيقية؛ ولا يُعد أي منهما بديلًا عن تشغيل مهمتك الخاصة.
أنماط الإدخال، ومسألة الملف تُركت مفتوحةً بصدق
تسرد صفحة نموذج OpenAI وسائط الإدخال المتمثلة في النص والصورة، مع إخراج نصي. لا يوجد صوت، ولا فيديو، ولا توليد صور في هذا النموذج.
يُدخَل إدخال الصورة كجزء من المحتوى داخل رسالة المستخدم. نوع الجزء هو input_image، وتُزوَّد الصورة إما كعنوان URL مؤهَّل بالكامل أو كعنوان URL لبيانات base64 في image_url، أو كـ file_id من Files API. وهناك detail اختياري بقيمة auto أو low أو high أو original، وقيمته الافتراضية auto. ويكون الشكل كالتالي:
{"model": "gpt-6-astra", "input": [{"role": "user", "content": [{"type": "input_text", "text": "ما الذي تغير في لقطة الشاشة هذه؟"}, {"type": "input_image", "image_url": "data:image/png;base64,...", "detail": "high"}]}]}
توثّق وثائق الرؤية لدى OpenAI أن صيغ PNG وJPEG وWEBP وGIF غير المتحركة مقبولة، بما يصل إلى 512 ميغابايت من إجمالي الحمولة لكل طلب، وما يصل إلى 1,500 صورة لكل طلب، مع رفض الصور التي تتجاوز 30,000 رقعة بدلًا من تصغير حجمها. وهذه هي حدود الرؤية العامة للمنصة وليست حدودًا خاصة بـ Astra، وتُحتسب الصور كرموز مثلها مثل أي مُدخل آخر.
الآن السؤال الذي يأتي به القرّاء فعلاً، والإجابة الصادقة. هل يمكنك إرسال ملفات أو PDF؟ لم نتمكّن من تأكيد إدخال المستندات لهذا النموذج في وثائق OpenAI، ولن نلمّح إلى أنه يعمل. تُعرّف Responses API جزء محتوى باسم input_file، لذا فالأساس التقني موجود في API عمومًا؛ لكن صفحة OpenAI الخاصة بـ GPT-6 Astra تُدرج النص والصورة ضمن أنماط الإدخال الخاصة به ولا تُدرج الملفات، ولم نعثر على أي بيان من OpenAI يوثّق إدخال PDF لنقطة النهاية هذه. ثمة قائمة من موجّه للنموذج نفسه تُظهر الملف إلى جانب النص والصورة — اعتبر ذلك منقولًا عن الموجّه، فهو ما يسجّله الموجّه عن مسار، لا ما يضمنه المورّد. إذا كان استيعاب المستندات محوريًا لعبء عملك، فاختبره مقابل نقطة النهاية الحقيقية قبل أن تبني عليه، وجهّز بديلًا احتياطيًا للتحويل من OCR إلى نص. هذا هو الفرق بين بعد ظهر من الاختبار وإعادة كتابة.
خط السعر الكامل، وتشغيل واحد طويل الأفق مُسعّر
تم أخذ كل رقم في هذا القسم من صفحة تسعير OpenAI الخاصة بتاريخ 16 سبتمبر 2026، وجميعها لكل مليون رمز في فئة Standard ما لم ينص السطر على خلاف ذلك.
• سياق قصير، حتى 272K من الإدخال — 10.00$ للإدخال، 1.00$ للإدخال المخزَّن مؤقتًا، 12.50$ لكتابة الذاكرة المؤقتة، 50.00$ للإخراج.
• سياق طويل، يتجاوز 272 ألف رمز إدخال — 20.00 دولارًا للإدخال، و2.00 دولارًا للإدخال المخزَّن مؤقتًا، و25.00 دولارًا لكتابة الذاكرة المؤقتة، و75.00 دولارًا للإخراج، وتُطبَّق على الطلب بالكامل.
• Batch and Flex — نصف سعر Standard: 5.00$ / 0.50$ / 6.25$ / 25.00$ للسياق القصير، 10.00$ / 1.00$ / 12.50$ / 37.50$ للسياق الطويل.
• الوضع السريع — ضعف Standard: $20.00 / $2.00 / $25.00 / $100.00 للسياق القصير، $40.00 / $4.00 / $50.00 / $150.00 للسياق الطويل. يلاحظ OpenAI أن الوضع السريع غير متاح لـ GPT-6 Astra مع إقامة البيانات في الاتحاد الأوروبي.
• إقامة البيانات — تتحمّل نقاط النهاية التي تستخدمها زيادة بنسبة 10% للنماذج الصادرة في 5 مارس 2026 أو بعده. وبما أن GPT-6 Astra مؤهّل، فإن نشر إقامة البيانات يكون أعلى بنسبة 10% من كل رقم مذكور أعلاه.
المبدأ الذي يجب استيعابه هو سعر الإدخال المخزَّن مؤقتًا. $1.00 مقابل $10.00 يمثل خصمًا بنسبة 90% على الجزء من المطالبة الذي ترسله مرة أخرى — وفي عبء عمل الوكيل، يمثل ذلك المطالبة بأكملها تقريبًا. تُحتسب عمليات الكتابة إلى الذاكرة المؤقتة بسعر $12.50، أو 1.25 ضعف سعر الإدخال غير المخزَّن مؤقتًا، لذا فإن نقطة التعادل بسيطة: إرسال 100,000 رمز دون تخزين مؤقت مرتين يكلّف $2.00، بينما كتابة تلك البادئة مرة واحدة وقراءتها مرة أخرى يكلّف $1.35. التخزين المؤقت يعود بالنفع بدءًا من إعادة الاستخدام الثانية فصاعدًا، والوكيل الذي يعمل على السجل نفسه لمئة جولة يعيد استخدامه مئة مرة.
وهذا يقودنا إلى الحساب الذي يحدد فعليًا ما إذا كان هذا النموذج ميسور التكلفة، لأن السعر المعلن ليس الرقم الذي يظهر في الفاتورة. إليك تشغيلًا مُنمذجًا — خاصتنا، مبني على أسعار OpenAI المنشورة، وليس فاتورة مقيسة — لنوع المهمة التي يُسوَّق لهذا النموذج من أجلها: وكيل برمجة ذاتي يعمل على ترحيل بحجم مستودع كامل خلال بضع ساعات، و120 استدعاءً للنموذج، وسجل عمل يبلغ في المتوسط نحو 500,000 رمز إدخال لكل استدعاء مع تراكمه، و80% من هذا الإدخال يُقدَّم من الذاكرة المؤقتة، و400,000 رمز إخراج عبر التشغيل بما في ذلك الاستدلال.
بأسعار Standard للسياق القصير:
• المدخلات غير المخزّنة مؤقتاً — 12 مليون رمز × 10.00 دولار = 120.00 دولار
• الإدخال المخزَّن مؤقتًا — 48 مليون رمز × $1.00 = $48.00
• الإخراج — 0.4 مليون توكن × $50.00 = $20.00
• الإجمالي ≈ $188.00 لهذه العملية
التشغيل نفسه في نطاق السياق الطويل، وهو ما تحصل عليه فعليًا النسخة النصية التي تتجاوز 272,000 رمز لكل استدعاء:
• الإدخال غير المخزّن مؤقتًا — 12 مليون توكن × 20.00 دولار = 240.00 دولار
• المدخلات المخزنة مؤقتًا — 48 مليون توكن × 2.00 دولار = 96.00 دولار
• الإخراج — 0.4 مليون رمز × $75.00 = $30.00
• الإجمالي ≈ 366.00 دولارًا لهذا التشغيل
ينتج عن ذلك استنتاجان، ولا يظهر أي منهما من المعدل الرئيسي المعلن. أولاً، مكان تخزين سجل المحادثة لديك لا يقل أهمية عن النموذج الذي تختاره — فالمهمة نفسها تتضاعف تقريباً تبعاً لما إذا كانت تتجاوز عتبة 272K، مما يجعل ضبط السياق (استرجاع 100K الصحيحة بدلاً من حمل 600K) أسلوباً للتحكم في التكلفة على هذا النموذج، وليس مجرد أسلوب للأداء. ثانياً، قيمة التخزين المؤقت أعلى مما يوحي به الخصم: فمع عدم وجود أي إصابات لذاكرة التخزين المؤقت على الإطلاق، يحمل السيناريو الأول مدخلات بقيمة $600.00 بدلاً من $168.00، وتكلفة التشغيل نحو $620 بدلاً من $188. فعِّل التخزين المؤقت قبل أن ترفع جهد الاستدلال.
بالنسبة لخط الأساس، فإن نفس مزيج الرموز على GPT-5.6 Sol بالأسعار التي عرضتها صفحة تسعير OpenAI في 16 سبتمبر — 4.00 دولار للمدخلات، و0.40 دولار للمدخلات المخزنة مؤقتًا، و20.00 دولار للمخرجات في السياق القصير — يبلغ حوالي 75.20 دولارًا، وعند صف السياق الطويل لـ Sol (8.00 / 0.80 / 30.00 دولار) حوالي 146.40 دولارًا. وهذا يجعل هذه الجولة حوالي 2.5x على أي من النطاقين. هناك تحذيران بشأن هذا المضاعف، لأنه تسبب بالفعل في ارتباك في مكان آخر: رقم Sol هو سعر ترويجي — تقول OpenAI إن العرض الترويجي متاح على الأقل حتى 21 نوفمبر 2026 — بينما سعر Astra هو سعر القائمة، لذا فإن المضاعف يقيس بطاقتي الأسعار الحاليتين وليس حقيقة ثابتة عن النماذج، ويضيق إذا انتهى العرض الترويجي. والمضاعف الأقدم "2.5x" الذي يتداول بشأن Astra يُحسب أحيانًا مقابل قائمة Sol قبل العرض الترويجي البالغة 5.00/30.00 دولار، مما يعطي 2x على المدخلات وحوالي 1.67x على المخرجات. حدد سعر Sol الذي تقصده وإلا فالرقم بلا قيمة.
سطر إضافي: فئة Batch تنصّف كل ذلك، لتصل التكلفة في التشغيل الأول إلى نحو $94. أما ما إذا كان بإمكانك استخدامها فيعتمد على القسم التالي.

عدم الاحتفاظ بالبيانات، والخصم الذي يُلغي نفسه
تذكر OpenAI أن الاحتفاظ الصفري بالبيانات متاح لعملاء API المؤهلين على نقاط النهاية المدعومة، رهناً بالموافقة — وكلا الشقين في تلك الجملة يؤدي دورًا حقيقيًا. وهو ليس مفتاحًا ذاتي الخدمة: الأهلية خاضعة لموافقة مسبقة من OpenAI وقبول متطلبات إضافية، وتبدأ العملية بالتواصل مع فريق المبيعات. بمجرد الموافقة، يتم تكوينه على مستوى المؤسسة أو المشروع ضمن الإعدادات ← المؤسسة ← عناصر التحكم في البيانات، في علامة تبويب الاحتفاظ بالبيانات، حيث يمكن للمشروع أن يرث الإعداد الافتراضي للمؤسسة، أو تعيين ZDR صراحةً، أو تحديد المراقبة المعدلة لإساءة الاستخدام، أو تعطيل كليهما.
ما الذي يغيّره عمليًا: يستبعد ZDR محتوى العملاء من سجلات مراقبة إساءة الاستخدام، مستبدلًا الاحتفاظ الافتراضي لمدة تصل إلى 30 يومًا، وتُعامَل معلمة store في /v1/responses و/v1/chat/completions على أنها false حتى إذا حاول طلب تعيينها إلى true.
التفصيل الأكثر أهمية في صفحة عن التكلفة: /v1/batches ليس ضمن قائمة نقاط النهاية المؤهلة لـ ZDR. تُدرجه صفحة ضوابط البيانات الخاصة بـ OpenAI على أنه غير مؤهل، مع الاحتفاظ بحالة التطبيق حتى حذفها. لذا، على GPT-6 Astra، لا يمكن الجمع بين خصم 50% في فئة Batch والاحتفاظ الصفري بالبيانات — عبء العمل الملتزم بالامتثال الذي يحتاج إلى ZDR ينبغي أن يخصص ميزانية بسعر Standard، لا سعر Batch، ومبلغ $94 المذكور أعلاه ليس متاحًا له.
ثلاث ملاحظات إضافية، نذكرها بوضوح لأن صفحة تبالغ في الترويج لـ ZDR أسوأ من صفحة تغفله. ZDR ليس مطلقًا: بموجب "Eyes Off"، تحتفظ OpenAI بالحق في جعل النماذج غير مؤهلة لـ ZDR لعملاء محددين، مع إشعار كتابي مسبق، وبموجب "Safety Retention" قد يُحتفظ بالمحتوى وتجري مراجعته بشريًا حيث تشير المصنفات إلى خطر شديد. أما مدخلات الصور والملفات التي تُعلَّم لاحتمال كونها CSAM فيُحتفظ بها للمراجعة اليدوية حتى في ظل ZDR. ويتوقف ZDR عند حدود OpenAI — فإذا استدعى وكيلك خادم MCP بعيدًا أو API تابعة لمورّد آخر، فإن حركة البيانات تلك تحكمها سياسة الاحتفاظ الخاصة بذلك الطرف، لا هذه السياسة. وبشكل منفصل، فإن إقامة البيانات ضابط مختلف عن ZDR، ويتطلب موافقة خاصة به وتعديلًا في "Modified Retention" خارج الولايات المتحدة، ويترتب عليه زيادة الـ10% المذكورة أعلاه. إذا كنت تعتمد على التخزين المؤقت في ظل ZDR، فاقرأ صفحة ضوابط البيانات لدى OpenAI لمعرفة ما يحتفظ به التخزين المؤقت؛ لن ننشر رقم احتفاظ خاصًا به لم نتمكن من قراءته هناك بأنفسنا.
حدود المعدل كما هي موثّقة، والحد الذي يلدغ أولًا
تنشر صفحة نموذج OpenAI هذه الحدود لكل فئة لـ GPT-6 Astra — الطلبات والرموز في الدقيقة، ثم حد قائمة انتظار الدفعات:
• المستوى 1 — 500 RPM، 500,000 TPM، قائمة انتظار الدفعات 1,500,000
• المستوى 2 — 5,000 RPM، 1,000,000 TPM، قائمة انتظار الدفعات 3,000,000
• المستوى 3 — 5,000 RPM، 2,000,000 TPM، قائمة انتظار الدفعات 100,000,000
• المستوى 4 — 10,000 دورة/دقيقة، 4,000,000 دورة/شهر، قائمة انتظار الدفعات 200,000,000
• المستوى 5 — 15,000 RPM، 40,000,000 TPM، قائمة انتظار الدفعات 15,000,000,000
حدّان سنسمّيهما غير موثّقين بدلًا من أن نملأهما: لا يوجد حدّ منشور للطبقة المجانية، لأن GPT-6 Astra ليس في الطبقة المجانية إطلاقًا؛ ولم نجد سقفًا منشورًا فوق المستوى 5 ولا جدولًا منفصلًا لحدود Fast mode. إذا لم ينشر مورّد حدًّا، فاعتبر الغياب غير محسوم — لا تفترض أنه غير محدود.
أول رقم يصطدم به حمل عمل الوكيل هو 500,000 TPM للطبقة الأولى. يمكن لنداء واحد على هذا النموذج أن يحمل سجلاً من 500,000 رمز، مما يعني طلب واحد يمكن أن يستهلك دقيقة كاملة من ميزانية الرموز لديك في الطبقة التمهيدية. نافذة سياق من مليون رمز لا تفيد كثيراً وكيلاً يحتكر نفس السجل عبر 120 دوراً إذا لم تستطع الطبقة تمرير الرموز. حدّد سعة الطبقة بناءً على حجم الرموز من المثال العملي أعلاه، لا بناءً على عدد الطلبات — ولاحظ أن ترقية الطبقة تعتمد على الإنفاق وسجل الحساب، لذا يجدر تثبيتها قبل الموعد النهائي بدلاً من خلاله.
Azure و AWS Bedrock، سطر واحد لكل منهما
• Microsoft Azure — يمكن نشر GPT-6 Astra في Microsoft Foundry تحت المعرّف نفسه gpt-6-astra، مع تأريخ تغطية Foundry للإتاحة العامة بأوائل سبتمبر 2026 والإبلاغ عن عمليات نشر Global Standard وUS Data Zone، دون EU Data Zone عند الإطلاق، وأسعار عند قائمة أسعار OpenAI أو قريبة منها مع صف للسياق الطويل. قرأنا ذلك من تغطية Foundry وليس من صفحة كتالوج Microsoft الخاصة، التي تعذّر علينا الوصول إليها اليوم — تحقق من قائمة النشر الحالية ومجموعة المناطق والسعر في وثائق Microsoft الخاصة قبل التخطيط لأي نشر عليه.
• AWS Bedrock — مُدرَج باسم openai.gpt-6-astra، ومتاح عبر واجهات Bedrock API المدعومة، ومؤكد في الموجز الأسبوعي لـ AWS بتاريخ 15 سبتمبر 2026، مع محيط الحوكمة الخاص بـ Bedrock (عزل نقطة نهاية VPC، وتشفير KMS، وGuardrails) وبيان AWS بأن بيانات الاستدلال لا تُستخدم لتدريب النموذج. يُفوتَر الاستدلال داخل المنطقة والاستدلال الجغرافي العابر للمناطق على Bedrock بزيادة 10% عن الأسعار الأساسية؛ هذا الرقم مأخوذ من مصدر غير مباشر وفق قراءتنا، لذا تحقق من صفحة التسعير الخاصة بـ AWS.
لا يغيّر أيٌّ من المسارين النموذج. لكن كليهما يغيّر المشتريات، وهذه هي النقطة الجوهرية بالنسبة لقارئ المؤسسات: فالنشر عبر Foundry أو Bedrock يمكن أن يندرج ضمن التزام سحابي قائم، ويرث هويته وإدارة وصوله (IAM) وسجلاته وحدوده الشبكية، ويظهر على فاتورة سبق أن اعتمدتها الإدارة المالية — وهو غالبًا الفرق بين مشروع تجريبي وشيء يُطلق فعليًا. المقايضة هي أنك تقبل دورة حياة النموذج لدى السحابة وسعر السحابة، وكلا السحابتين مُبلَّغ عنهما عند سعر قائمة OpenAI أو أعلى منه، لا أدنى.
أين يندرج جهاز التوجيه، بما في ذلك الأجزاء التي تعارضه
يتوفر GPT-6 Astra في كتالوج OrcaRouter باسم openai/gpt-6-astra، وتقوم OrcaRouter بتمرير سعر قائمة المزود كما هو بهامش ربح 0% — سعر المورد هو سعرنا، وأي تغيير في سعر المورد يظهر في فاتورتك في نفس اليوم بدلاً من التجديد. بالنسبة لطراز بهذا السعر، هذا ليس ادعاءً بخطأ تقريب: الحساب أعلاه هو نفس الحساب الذي ستدفعه مباشرة.

الحجة الصادقة لصالح التوجيه هنا ليست السعر، بل قابلية التراجع. تبلغ تكلفة Astra نحو 2.5 ضعف النموذج الأدنى منها، وتتأرجح تكلفتها وفق عتبة تتحكم بها بنيتك المعمارية، لذا يرغب معظم الفرق في تجربتها على شريحة من حركة الإنتاج الحقيقية قبل الالتزام بمسار إنتاجي. عبر مفتاح واحد يمكنك وضعها خلف نفس نقطة النهاية التي تعمل عليها النماذج التي تشغّلها بالفعل، وإرسال جزء من الحركة إليها، والتحويل تلقائيًا عند الفشل إلى خيار أرخص عندما لا تستحق الفارق — تغيير في الإعدادات لا عملية ترحيل، مع واجهة API واحدة تغطي أكثر من 200 نموذج، ولغة توجيه DSL تجمع عدة نماذج في نداء واحد، ودمج النماذج عندما تريد مجموعة تجيب معًا.
الجوانب التي تعارض ذلك، مصوغة بصراحة. الراوتر هو محطة إضافية في مسار الطلب وطرف إضافي في تدفق البيانات — وفي هذا النموذج، هذا ليس افتراضيًا، لأن ZDR يُعتمد لكل مؤسسة على حدة في OpenAI، والطلب الموجّه لا يغطيه اعتماد ZDR الخاص بك تلقائيًا. إذا كنت ترسل بيانات خاضعة للتنظيم، فتأكد من الشروط المتعلقة ببيانات المسار قبل إرسالها، وكن مستعدًا للاتصال بالمورّد مباشرة بخصوص عبء العمل هذا. كما يضيف التوجيه مكوّنًا قد يتعطل أو يزيد زمن الاستجابة، ويجعل تبديل النماذج سهلًا لدرجة أنه يصبح من الممكن تغيير ما يجيب مستخدميك دون مراجعته. لا شيء من ذلك يفوق حجة التجربة وإمكانية التراجع بالنسبة لمعظم الفرق؛ وكل ذلك يستحق المعرفة قبل أن تقرر أن الراوتر مجاني. طرحنا منصات التوجيه مقابل بعضها بعضًا في مقال منفصل بدلًا من إعادة صياغة المقارنة هنا.
ثلاثة أسئلة ليست إجاباتها بجملة واحدة
هل يمكنني ضبط GPT-6 Astra ضبطًا دقيقًا، أو استخدامه مع Assistants API؟ لا، في كلتا الحالتين، وهذا حدّ تصميمي وليس إعدادًا فوّته عليك. تُدرج صفحة طرازات OpenAI نقاط النهاية المدعومة Chat Completions وResponses وBatch، وتُدرج صراحةً Fine-tuning وAssistants ضمن غير المدعومة، ولا يوجد صفّ GPT-6 Astra في جدول أسعار الضبط الدقيق لدى OpenAI. إذا كان معمارك يعتمد على طراز رائد مضبوط ضبطًا دقيقًا، فيتعيّن بدلًا من ذلك توجيه المطالبات إلى Astra، ما ينقل التكلفة من التدريب إلى رموز الإدخال — وبسعر 10.00 دولارات لكل مليون على موجّه نظام كبير، فهذا بند ميزانية حقيقي وليس حاشية.
هل سيرفض النموذج القيام بعمل أمني مصرّح لي به؟ أحيانًا، نعم، ويستحق الأمر معرفة ذلك قبل أن تبني. إن GPT-6 Astra هو أول نموذج من OpenAI يصل إلى عتبة قدرات الأمن السيبراني الحرجة بموجب إطار الجاهزية الخاص بالشركة، وفي النسخة المطروحة منه يرفض المهام السيبرانية المتقدمة مثل كتابة استغلالات إثبات المفهوم. تقول OpenAI إنها تخطط لتوسيع الوصول بضمانات أقل تقييدًا عبر برنامج Daybreak. وبالنسبة لأي مدافع، يظهر هذا كرفض لا كحد لمعدل الطلبات وليس كخلل برمجي — خصص له قدرًا في معالجة الأخطاء لديك بدلًا من إعادة المحاولة فيه.
هل أحتاج إلى موافقة خاصة لاستدعاء هذا النموذج؟ ليس لنقطة النهاية القياسية — فلا توجد قائمة انتظار ولا خطوة موافقة لاستدعاء gpt-6-astra، فقط حساب مع الفوترة. ما قد تحتاج إلى موافقة بشأنه هو كل ما يحيط به: Zero Data Retention، وهو مُقيَّد بالطلب؛ وإقامة البيانات خارج الولايات المتحدة، التي تحتاج إلى تعديل خاص بها؛ وترقية المستوى، إذا كنت تنوي دفع أحجام رموز بمقياس الوكلاء عبر حساب من المستوى 1. النموذج هو الجزء السهل في عملية الشراء.
ما الذي يجب مراقبته، ومن ينبغي أن يتحرك الآن
إذا كنت تبني على هذا النموذج، فإن الأمور الأربعة الجديرة بالمراقبة كلها من جهة المورّد وكلها مؤرخة. ما إذا كانت OpenAI تنشر لقطة مؤرخة لـ gpt-6-astra — وهو ما سيحوّل المعرّف المجرّد إلى هدف متحرك ويجعل التثبيت ذا معنى. ما إذا كانت عتبة 272,000 توكن تتغيّر، لأن هذا السطر الواحد يساوي على فاتورتك أكثر من أي مقياس أداء في الصفحة. ما إذا كانت أسعار Bedrock وFoundry تتقارب مع قائمة OpenAI أو تبقى فوقها، لأن ذلك يحدد مسار الشراء بقدر ما يحدده النموذج. وما إذا كان برنامج Daybreak يغيّر ما سترفضه نقطة النهاية، وهو بالنسبة لفرق الأمن الفرق بين أداة قابلة للاستخدام وعرض توضيحي.
أما من ينبغي أن يتحرك، فالانقسام واضح. إذا كنت تدفع بالفعل مقابل GPT-5.6 Sol بأسعار ترويجية لأعمال الوكلاء طويلة الأفق، فإن مضاعف 2.5x حقيقي والسؤال ضيق: هل يتفوق معدل إنجاز المهام على عبء عملك الخاص على فرق السعر؟ شغّله على شريحة من حركة المرور الحقيقية واكتشف — المثال المشروح أعلاه يخبرك بتكلفة الشريحة قبل أن تبدأ. إذا كان عملك محادثة قصيرة السياق أو تصنيفًا بحجم كبير، فهذا ليس نموذجك؛ فإعادة تسعير السياق الطويل وسعر الإخراج البالغ 50.00 دولارًا يجعلانه طريقة مكلفة للقيام بشيء يفعله GPT-5.6 Luna بجزء بسيط من السعر. وإذا كنت مؤسسة لديها متطلب امتثال، فابدأ نقاش ZDR أولًا، لأنه يتحكم في خصم Batch وزيادة الإقامة واختيارك للمسار — ولا شيء من ذلك قرار يمكنك اتخاذه في اليوم الذي تحتاجه فيه.
مقارنات في هذه المقالة2
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
