بطاقة رئيسية لـ Claude Sonnet 5.5 بعنوان «اختبار خفي، أو قائمة الأسعار التي لديك بالفعل»، مع ثلاث شارات نصية تقول «لم يُصدَر بعد» و«لم يُنشَر أي معرّف للنموذج» و«مُعلَن: خلال الأسابيع المقبلة»، وتذييل يستشهد بمنشور على X بتاريخ 24 سبتمبر 2026 ومنشور إطلاق Anthropic لـ Opus 5.5 بتاريخ 22 سبتمبر 2026، وشعار OrcaRouter في أسفل اليمين
Guides & Insights

Claude Sonnet 5.5: تسريب اختبار خفي مبني على أربعة أرقام موجودة بالفعل

الكاتب

Alistair Wren

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

نُشِرَت أربعة أرقام على X في 24 سبتمبر كدليل على أن Claude Sonnet 5.5 "يخضع بالفعل لاختبار خفي": نافذة سياق بسعة 1M رمز، وحد أقصى للإخراج 128K رمز، و2 دولار لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج. الأرقام الأربعة كلها موجودة الآن في قائمة أسعار Anthropic نفسها، مرتبطة بـ Claude Sonnet 5 — النموذج الذي ستحل نسخة 5.5 محله، والمتاح عمومًا منذ 30 يونيو 2026. ويعود السعران المعلنان نفسهما، 2 دولار / 10 دولارات، أيضًا إلى GPT-6 Sol، الذي أطلقته OpenAI في 22 سبتمبر، وهذا التداخل هو ما يجعل المنشور يُقرأ كردّ على OpenAI لا كتحديث روتيني للفئة: "يبدو لي هذا ردًا مباشرًا على GPT-6-Sol. السعر نفسه، ويفترض أن الأداء مشابه."

لا شيء من ذلك يجعل الادعاء خاطئًا. إنه يجعل الادعاء غير قابل للتكذيب، وهذه مشكلة مختلفة وأكثر فائدة يمكن تدوينها. رصد اختبار تخفٍّ لا يكون أفضل من الأثر الذي يقف خلفه، والأثر الكامن خلف هذا الرصد هو ورقة مواصفات لا يمكن تمييزها عن النموذج الذي تقدمه Anthropic منذ اثني عشر أسبوعًا.

ما الذي تم نشره فعليًا؟

المصدر هو منشور واحد على X من حساب @kimmonismus، بتاريخ 24 سبتمبر 2026. يذكر نافذة السياق، وسقف الإخراج، والسعرين، ويقارن التسعير بـ GPT-6 Sol، ويستنتج أن Sonnet 5.5 قيد الاختبار. لا توجد لقطة شاشة، ولا سلسلة تعريف للنموذج، ولا استجابة من واجهة برمجة التطبيقات، ولا قائمة من وحدة التحكم، ولا وصف من المختبرين للسلوك، ولا مراقب ثانٍ مرتبط بأيٍّ من ذلك. المنشور ادّعاء يحوي أرقامًا، والأرقام هي الحدود العلنية لهذه الفئة.

هذا يستحق الفصل عن النوع الآخر من قصة Anthropic لما قبل الإصدار، لأن عام 2026 أنتج كليهما وهما لا يشبهان بعضهما إطلاقًا. كانت معرّفات الوصول المبكر في أغسطس claude-marshmallow-eap وclaude-melon-eap سلاسل نصية موجودة في الطلبات — قبيحة، غير جذابة، وقابلة للتحقق. أما قصة Opus 5.2 الممتدة خلال سبتمبر فهي تقرير توجيه: مطوّرون يلاحظون أن الواجهة الخلفية وراء تسمية "Opus 5" أجابت بشكل مختلف، ويصفون السلوك. كلاهما أثر مادي. "يجري اختباره بالفعل بشكل خفي" دون أي أثر مادي مرفق هو ملخّص لما تبيعه فئة Sonnet بالفعل.

هناك أيضًا نمط يستحق الملاحظة في المصدر نفسه. نشر الحساب نفسه ملخصًا في 20 سبتمبر افتُتِح بأربعة نماذج قال إنه "يرى اختبارات لها بالفعل" — Claude Sonnet 5.2 وClaude Opus 5.2 وClaude Fable 5.2 وGemini 4 Pro. من بين هذه الأسماء الأربعة، لدى مدخلي Opus وFable تقارير منفصلة ومؤكَّدة تدعمهما، ولدى مدخل Gemini مشاهدات خاصة به. كان لمدخل Sonnet موضع في قائمة. بعد أربعة أيام، نما ادعاء Sonnet ليصبح ورقة مواصفات، وورقة المواصفات هي النموذج الموجود بالفعل.

الأرقام الأربعة هي أرقام Claude Sonnet 5

هذا هو الجزء الذي يستغرق ثلاثين ثانية للتحقق منه، ولا يفعله تقريبًا أي أحد. صفحة نظرة عامة على نماذج Anthropic، كما قُرئت اليوم، تُدرج Claude Sonnet 5 بنافذة سياق تبلغ مليون رمز، و128 ألفًا كحد أقصى للإخراج، و2 دولار / 10 دولارات لكل مليون رمز. ضع التسريب في مقابل ذلك:

• نافذة السياق — 1M رمز مُعلَن لـ Claude Sonnet 5.5؛ 1M رمز منشور لـ Claude Sonnet 5

• الحد الأقصى للإخراج — ‏128 ألف رمز مُعلَن؛ ‏128 ألف رمز منشور

• سعر الإدخال — ‏$2 لكل مليون مُطالَب به؛ ‏$2 لكل مليون منشور

• سعر المخرجات — $10 لكل مليون مُطالَب به؛ $10 لكل مليون منشور

• معرّف النموذج — لا شيء منشور لـ Claude Sonnet 5.5؛ claude-sonnet-5 لـ Claude Sonnet 5

• درجات مستقلة — لا شيء منها للنموذج المزعوم؛ يصنّف Artificial Analysis نموذج Claude Sonnet 5 عند مؤشر ذكاء قدره 38 في المرتبة 54 من بين 210 نماذج يقيسها، في إعداد الاستدلال التكيفي بأقصى جهد

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

هناك طبقة ثانية لنقطة التسعير هذه يقلبها التسريب. فعند إطلاق Claude Sonnet 5، أُعلن سعر $2 / $10 كتسعير تمهيدي يسري حتى 31 أغسطس 2026، مع زيادة مقررة إلى $3 / $15 في 1 سبتمبر. تلك الزيادة لم تحدث. وتتضمن صفحة تسعير Anthropic الآن حاشية تقول إن $2 / $10 "أصبح الآن السعر القياسي"، وإن "الزيادة المقررة سابقًا إلى $3 / $15 لكل مليون رمز إدخال/إخراج في 1 سبتمبر 2026 لن تحدث". إذن السعر الذي يقدّمه التسريب كسلاح تنافسي للطراز الجديد هو السعر الدائم للطراز الحالي — ما يعني أن Sonnet 5.5 إذا أُطلق بسعر $2 / $10 فسيُطلق بلا أي خصم على الإطلاق، ضمن فئة مسعّرة بالفعل في مواجهة GPT-6 Sol.

الشيء الوحيد الذي قالته Anthropic فعلاً

إذا استبعدنا كل ما جاء من مصادر مسرّبة مجهولة، فلا تبقى سوى جملة واحدة من مصدر رسمي. عندما أطلقت Anthropic نموذج Claude Opus 5.5 في 22 سبتمبر 2026، قالت إن Claude Sonnet 5.5 وClaude Haiku 5.5 سيتبعانه "في الأسابيع المقبلة"، محققين مكاسب مماثلة في الأداء والكفاءة والسلامة. تلك الجملة هي السجل المؤكد بالكامل. فهي لا تحمل أي معرّف نموذج، ولا نافذة سياق، ولا سعر، ولا اختبار قياسي، ولا تاريخ — وعلى وجه الخصوص، لا تقول أي شيء عن اختبار خفي، أو مسار رمادي، أو أي نوع من الاختبارات.

تتفق بقية واجهة Anthropic العامة مع هذا التفسير. لا تزال نظرة عامة النماذج تسرد أربعة نماذج — Claude Fable 5.1 وClaude Opus 5.5 وClaude Sonnet 5 وClaude Haiku 4.5 — دون صف خامس، ولا بند تسعير، ولا علامة «قادم» لخلفٍ لـ Sonnet. إذا كان قد جرى تقديم نقطة تحقق من فئة Sonnet في مكان يستطيع مطوّر الوصول إليه، لكان المُعرّف أول ما يظهر، لأن النموذج المُقدَّم يجب أن يكون له اسم في الطلب. ولم يظهر أي شيء.

شيء واحد حسمه إعلان سبتمبر: أنه ناقض التسريب الأسبق الذي زعم أن سلسلة Haiku ستُوقف وأن الجيل 5.5 سيعيد هيكلة التشكيلة. إن Haiku 5.5 قادم، وفقًا لـ Anthropic، ما يعني أن رواية إعادة الهيكلة كانت خاطئة في الاتجاه الذي نادرًا ما تكون فيه التسريبات خاطئة — فالفئة الرخيصة باقية.

قال تسريب أغسطس إنه 2 مليون توكن. أما هذا فيقول 1 مليون.

قبل ستة أسابيع من منشور 24 سبتمبر، وفي 9 أغسطس، نشر حساب مختلف على X ورقة مواصفات بعنوان "SONNET 5.5 LEAK" تتضمن ادعاءً أكثر جرأة بكثير: نافذة سياق تبلغ مليوني توكن، أي ضعف Sonnet 5، واستدلال أسرع، واستخدام أفضل لأدوات المتصفح والطرفية، وأداء يقترب من Claude Fable 5، وإصدار "الشهر المقبل". وجاء ذلك التسريب مع رسم مصمم ليبدو كبطاقة معاينة من Anthropic. وجاء أيضًا بتفصيل قاتل تعلّق به منتقدوه فورًا: الاسم الرمزي الذي أطلقه، "Fennec"، كان الاسم الرمزي الذي شُحن بالفعل مع Claude Sonnet 5 في 30 يونيو. لا يمكن أن يكون الاسم الرمزي دليلًا جديدًا على وجود خليفة للنموذج الذي استخدمه.

إذن، تختلف موجتا التسريب حول الرقم الأكثر استشهادًا به. قال أغسطس 2M سياق. يقول سبتمبر 1M. لا يمكن أن يصف كلاهما نفس الإصدار. أكثر الاحتمالات ترجيحًا هو التفسير الممل: منشور سبتمبر يصف الحدود المنشورة لفئة Sonnet لأن هذا ما يبدو عليه نموذج من فئة Sonnet من الخارج، وكان منشور أغسطس تخمينًا لما قد يضاعفه تحديث بشكل معقول. لاحظ الاتجاه الذي تحرك فيه الرقم — نحو الأسفل، نحو ما هو موجود بالفعل.

إذن، هل مقارنة GPT-6 Sol صحيحة؟

في الغالب، والموضع الذي ينكسر عنده هو الجزء المثير للاهتمام. طُرح GPT-6 Sol في 22 سبتمبر 2026، في اليوم نفسه الذي طُرح فيه Claude Opus 5.5، ويبدأ سعر القائمة لديه عند $2 لكل مليون إدخال و$10 لكل مليون إخراج — وهو تمامًا سعر Sonnet 5، وتمامًا ما يدّعيه التسريب بشأن Sonnet 5.5. وهو يوفّر نافذة سياق تبلغ 1,050,000 توكن مع سقف إخراج يبلغ 128K، وكلاهما بفارق طفيف عن أرقام Claude Sonnet 5. أما الشقيق الأرخص، GPT-6 Luna، فيستقر عند $0.10 / $0.50.

الفرق هو السياق الطويل. يسعّر GPT-6 Sol بفئتين: 2 دولار / 10 دولارات حتى 272,000 توكن إدخال، ثم 4 دولارات / 15 دولارًا بعد ذلك. لا تفعل Anthropic ذلك في خط Sonnet — إذ تحاسب Claude Sonnet 5 النافذة الكاملة البالغة 1M بالأسعار القياسية، لذا فإن طلبًا بحجم 900K توكن يكلف نفس السعر لكل توكن مثل طلب بحجم 9K. وبالتالي فإن المقارنة بين Sonnet 5.5 حقيقي وGPT-6 Sol حقيقي هي تعادل سعري للمطالبات العادية وفجوة بمقدار الضعف لأحمال العمل الخاصة بالمستندات الطويلة والمستودعات الكبيرة التي يُباع كلا الطرازين من أجلها. إن عبارة "نفس التسعير" صحيحة في العنوان الرئيسي وخاطئة في أحمال العمل التي تُختار فيها الفئة.

ثمّة تحفّظ ثانٍ يكمُن تحت المقارنة بأكملها. يستخدم Claude Sonnet 5 مُرمِّز الرموز الأحدث من Anthropic، الذي ينتج رموزًا أكثر بنحو 30% للنص نفسه مقارنةً بالمُرمِّز السابق. المعدل المعلن ليس فاتورة؛ الفاتورة هي عدد الرموز لكل مهمة، وهذا هو الرقم الذي لم يحمله أي تسريب قط.

ما الذي قد يجعل Sonnet 5.5 مهمًا؟

ضعْ جانبًا مسألة ما إذا كان موجودًا واسأل عمّا الذي سيتغيّر بالنسبة لشخص يدفع مقابل الرموز. أربعة أشياء، ولا شيء منها ورقة مواصفات.

الأول هو سعر دون $2 / $10. ومع إلغاء الزيادة المقررة في 1 سبتمبر، أصبح سعر الطراز الحالي دائماً — لذا فإن خلفاً يحافظ على السعر نفسه يُعد نقلة جانبية، والخبر الوحيد في فئة Sonnet الذي يحرّك المال هو خفض السعر.

الثاني هو سياق يتجاوز 1M. كان ذلك هو الطرح الفعلي لتسريب أغسطس، وهو الفجوة الوحيدة في القدرات التي يمكن للتسريب أن يسمّيها ولا يغطيها اللاعب المهيمن بالفعل.

والثالث هو عدد الرموز لكل مهمة. فالتفكير التكيفي في Claude Sonnet 5 مُفعَّل افتراضيًا، وقد قاس تحليل مستقل أنه يولّد عددًا أكبر بكثير من رموز الإخراج لكل مهمة مقارنة بسابقه. ونسخة تحافظ على سعر 2 دولار / 10 دولارات وتوقف هذا التضخم ستخفض الفواتير الفعلية أكثر من خفض السعر المعلن.

الرابع هو مُعرّف. سلسلة نموذج API، أو صفّ في الوثائق، أو بند تسعير، أو بطاقة نموذج — أيّ واحد من هؤلاء يحسم الجدل، وغياب الأربعة جميعًا بعد تسريب بهذا القدر من الصراحة هو بحد ذاته أكثر ما يفصح عن الحقيقة في هذه القصة.

ما الذي يمكنك تسميته اليوم

Claude Sonnet 5 ليس بديلاً مؤقتًا ريثما تُرتّب الفئة أمورها. إنه النموذج الذي تعمل عليه بالفعل معظم حركة Claude API، بنافذة 1M رمز، ومخرجات 128K، وبسعر 2$ / 10$ الذي أصبح الآن معيارًا لا عرضًا ترويجيًا.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

إنه متاح على OrcaRouter منذ يونيو بسعر Anthropic نفسه البالغ 2 دولار / 10 دولارات، يُمرَّر بسعر قائمة المزوّد دون أي هامش، لذا فإن أي تغيير في سعر المورّد على خط Sonnet سيصبح ساريًا هنا في اليوم نفسه بدلًا من دورة الفوترة التالية. المفتاح نفسه يصل بالفعل إلى GPT-6 Sol بسعر 2 دولار / 10 دولارات، وهذا يهم أكثر من المعتاد في مقال كهذا: المقارنة التي يعتمد عليها التسريب هي مقارنة يمكنك إجراؤها بنفسك باستخدام بيانات اعتماد واحدة بدلًا من عقدين.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

وهذه أيضًا أرخص طريقة للإجابة عن السؤال الذي يطرحه التسريب. إذا ظهر Sonnet 5.5، فإنه يصل إلى الكتالوج مثل أي شيء آخر، وتوجّه شريحة من حركة المرور إليه خلف تحويل تلقائي عند الفشل إلى Claude Sonnet 5 — بلا تكامل ثانٍ، وبلا إعادة تفاوض، وبلا مسار إنتاج يعتمد على نموذج لم يقم أحد باختباره بمعايير مستقلة. إن تجربة مستوى غير مُثبت هي قرار توجيه، وليست مشروع ترحيل.

ماذا تشاهد بدلًا من منشور التسريب التالي

ثلاث إشارات، بترتيب تنازلي حسب مقدار ما ستخبرك به. المُعرّف حاسم، لأن النموذج المُقدَّم يجب أن يكون له اسم في الطلب، وهكذا أصبحت كل قصة قابلة للتحقق حول إصدار Anthropic قبل طرحه في 2026 قابلة للتحقق. إقرار من المورّد — بطاقة نموذج، أو صف في الوثائق، أو سطر تسعير، أو مجرد ظهور النموذج في قائمة Anthropic الخاصة — ينهي الأمر نهائيًا؛ جملة "الأسابيع القادمة" تعني أن أحد هذه الأمور مستحق حقًا. تقرير المُختبِر الذي يصف السلوك وليس المواصفات هو الأضعف بين الثلاثة، ومع ذلك فهو أكثر مما هو موجود اليوم.

حتى يصدر أحدها، الخلاصة الصادقة هي أن Anthropic قد وعدت بتحديث Sonnet خلال الأسابيع المقبلة، وقد وصفه أحد المراقبين باستخدام أرقام النموذج الذي سيحل محله. إذا كانت منظومتك التقنية تشغّل claude-sonnet-5 بالفعل، فلا يوجد ما تنتظره ولا شيء تخطط من حوله. وإذا كنت توازن بين Claude Sonnet 5 وGPT-6 Sol، فالأرقام التي يمكنك العمل بناءً عليها هي تلك المنشورة بالفعل — وهي نفس الأرقام التي يحاول التسريب بيعها لك كخبر جديد.

مقارنات في هذه المقالة2

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا