بطاقة رئيسية لتسريب Claude Sonnet 5.2: لوحة "ما نعرفه حتى الآن" تُدرج الحالة كغير مُصدَر مع مدخل قائمة واحد وبدون معرّف، تسمية مراقب غير مؤكدة، أدلة محدودة بمنشور تجميعي وعنوان رئيسي واحد، لا معرّفات منشورة، لا اختبارات أداء، و Claude Sonnet 5 باعتباره النموذج الذي تم إصداره فعليًا، متاح عمومًا منذ 30 يونيو.
Guides & Insights

Claude Sonnet 5.2: مُدخل قائمة واحد، وصفر مُعرِّفات — ما المعروف فعليًا

الكاتب

Gideon Frost

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

وصل Claude Sonnet 5.2 إلى الإنترنت بوصفه البند الأول في قائمة. في 20 سبتمبر، نشر حساب X ‏@kimmonismus ملخصًا استهلّه بالنماذج التي قال إنها "تشهد بالفعل اختبارات لها" — Claude Sonnet 5.2 وClaude Opus 5.2 وClaude Fable 5.2 وGemini 4 Pro — ثم انتقل إلى الإصدارات التي توقّع صدورها لاحقًا. كل ما جاء بعد ذلك الاسم الأول يقف خلفه شيء. لدى Claude Opus 5.2 أسبوع من التقارير حول قناة توجيه صامتة داخل Claude Code. ولدى Claude Fable 5.2 سلسلة تسريبات خاصة به. ولدى Gemini 4 Pro مشاهدات منفصلة. ولدى Claude Sonnet 5.2 موضع في قائمة. هذا هو كامل السجل العام حتى صباح اليوم: تغريدة واحدة، وعنوان واحد على مجمّع منخفض التحقق، ولا معرّف ولا سعر ولا نافذة سياق ولا معيار أداء في أي مكان. Claude Sonnet 5 — النموذج الذي سيحل 5.2 محله — متاح عمومًا منذ 30 يونيو بسعر دولارين لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج، وهو النموذج الافتراضي في كل فئة اشتراك من Claude.

عدم التماثل هذا هو القصة الجديرة بالتدوين، لأنه الشيء الذي يضيع عندما تُقرأ تغريدة تجميعية كحدث إخباري. إن ظهور اسم نموذج في قائمة ليس نوع الادعاء نفسه الذي يمثله ظهور اسم نموذج بجوار معرّف نموذج، والفرق هو الفرق كله بين "تحديث Sonnet قادم" و"أن أحدهم جمع كلمة Sonnet مع الرقم 5.2".

ما الذي يقوله منشور 20 سبتمبر في الواقع

اقرأ المنشور عن كثب، فادعاء Sonnet أضعف حتى مما يوحي به العنوان. القائمة مقسمة إلى نصفين، ويقع Sonnet 5.2 في النصف الأول — نصف "نراه قيد الاختبار بالفعل" — وهو الأقوى بين الادعاءين. النصف الثاني مُتحفَّظ عليه صراحةً: "تأكيد أو تلميحات لإصدارات قادمة"، ويشمل Grok 4.7 وGPT-6-Sol وKimi K3.1، مع أن سطر GPT-6-Sol يحمل حتى تحذيره الخاص بأن إصدارًا كبيرًا تم التلميح إليه ليوم الثلاثاء "قد يكون هو".

إذن، المؤلف متحفّظ في نصف المنشور وغير متحفّظ في النصف الآخر، وSonnet 5.2 يقع في النصف غير المتحفّظ. لا لقطة شاشة، ولا استجابة API، ولا سلسلة طراز، ولا تقرير مختبِر، ولا توقيت. القارئ الذي يريد التحقق من الادعاء لا يجد شيئًا يتحقق به منه.

المكان الآخر الوحيد الذي يظهر فيه الاسم علنًا هو منشور تجميعي بتاريخ 19 سبتمبر، عنوانه يقول "تسريب Fable 5.2 وOpus 5.2 وSonnet 5.2." افتحه، ويظهر Sonnet 5.2 في العنوان ثم لا يظهر مرة أخرى مطلقًا في المتن، حيث تُجمع أسماء Claude الثلاثة في جملة واحدة عن "تقدم ملحوظ" عبر المنصة. لا يقدّم ذلك المنشور أي دليل على أيٍّ من الثلاثة، ويحذّر صراحةً من أنه ينبغي التعامل مع المعايير المزيفة بحذر. ظهوران، بالشكل نفسه: اسم داخل مجموعة، لا شيء مرتبط به على حدة.

المفقود هو الأثر المحدد القابل للتحقق الذي أنتجه كل تسريب حقيقي من Anthropic في 2026. في أغسطس، كانت قصة Marshmallow وMelon قد تضمنت حركة API قابلة للملاحظة على سلسلة نصية تُسمى claude-marshmallow-ht-eap ومتغيرات أنظف بعدها. أما قصة Opus 5.2 هذا الشهر فيبلغ مطورون بأن الـslug الخلفي وراء تسمية «Opus 5» يشير إلى مكان جديد. أما Sonnet 5.2 فلا يملك أيًا منهما. إذا كانت نقطة تحقق من فئة Sonnet تُقدَّم في أي مكان يستطيع مطور الوصول إليه، فسيكون المعرّف أول ما يتسرب، لأنه أكثر ما يصعب إخفاؤه — إذ لا بد أن يوجد في طلب.

الجزء المؤيَّد من قصة سبتمبر ليس Sonnet

هنا يكمن الفخ في قراءة ذلك الملخّص. إن قصة الاختبار الرمادي لدى Anthropic المؤكدة التي امتدت خلال سبتمبر هي قصة من فئة Opus. ذكرت منافذ إخبارية متعددة، بالصينية والإنجليزية، أن Anthropic كانت توجّه بهدوء جزءًا من الطلبات إلى نقطة تحقق غير مُصدَرَة تحت مسمّى Opus 5 — اختبار رمادي صامت لاحظه المطوّرون عبر تغيّر السلوك لا عبر تغيّر الأسماء. ووصف تقرير في ليلة 17 سبتمبر قطع القناة دون إشعار ثم استعادتها بعد نحو يوم، وبعد ذلك قيل إنها توسّعت من Claude Code إلى واجهات الدردشة والعمل التعاوني. والاسم المرتبط بنقطة التحقق تلك في التقرير هو Claude Opus 5.2.

يرث Sonnet 5.2 مصداقية ذلك التقرير دون أن يرث أيًا من أدلته. هذا نمط فشل محدد وشائع في تغطية التسريبات: تُوثَّق طبقة واحدة، ثم تُذكر طبقة ثانية في السياق نفسه، ثم يتناقل الاسم الثاني كما لو كان قد ورد في التقارير أيضًا. لكنه لم يرد. إذا بحثت عن تقرير توجيه من فئة Sonnet، فستجد تقرير Opus وقائمة.

هناك خيط منفصل، أفضل استنادًا إلى المصادر، يمتد تحت كل هذا — ألا وهو التقارير التجارية التي تفيد بأن Anthropic قد أرجأت إدراجها إلى نوفمبر، وأنها، وفقًا لـ Reuters نقلًا عن ثلاثة مصادر، تدرس ما إذا كانت ستطلق نموذجًا جديدًا قبله للرد على GPT-6 Astra. هذه التقارير حقيقية وذات صلة. ومن الجدير بالملاحظة أنها صامتة أيضًا بشأن الفئة التي سيكون عليها النموذج. فتحديث لنموذج أساسي معتمد وإطلاق لنموذج رائد خطوتان مختلفتان تمامًا قبل طرح عام أولي، ولا شيء مما نُشر حتى الآن يقول أيهما قيد النظر.

في الشهر الماضي، أطلق المجتمع اسمًا على Sonnet لم يُطرح قط

أقوى حجة للتشكيك في "Sonnet 5.2" ليست أن الادعاء واهن، بل أن نمط التسمية هذا نفسه قد فشل قبل شهر واحد، على الملأ، والفشل موثّق.

في أواخر أغسطس، انتشر معرّفان للوصول المبكر: claude-marshmallow-eap و claude-melon-eapلا تحتوي أي من السلسلتين على الكلمات Opus أو Sonnet أو أي رقم إصدار. في 24 أغسطس، ألصقت منشورات التواصل الاجتماعي ومدونات الشائعات أسماء منتجات بها من الخارج — أصبح Marshmallow "Opus 5.1"، وأصبح Melon "Sonnet 5.1" — استنادًا إلى انطباعات المختبِرين بأن Marshmallow بدا أقوى من Melon وأقوى من Opus 5 السائد آنذاك. ويُقال إن أحد المطورين الذين حققوا في الأمر وجد أن السلاسل المجردة لم تنتج أي مخرجات للطرف الأول يمكن التحقق منها، مما جعل حركة المرور السابقة الدليل الوحيد القابل للملاحظة.

لم يصدر أيٌّ من الاسمين. كان الإصدار التالي من Anthropic في تلك النافذة هو Claude Fable 5.1، في الأول من سبتمبر — فئة مختلفة تمامًا، تحت اسم لم يُسنده أحد إلى أيٍّ من المُعرّفين. أما تسمية «Sonnet 5.1» فقد كانت استنتاجًا من المجتمع تحوّل إلى شائعة ثم تبخّر.

هذا التاريخ يهم هنا لسبب يتجاوز الحذر العام. فهو يعني أن فئة Sonnet قد ذُكرت الآن في التسريبات مرتين خلال شهرين دون وجود أي أثر خاص بالفئة في أي من المرتين. كما يعني أن أقوى احتمال مسبق — الوتيرة الفعلية لـ Anthropic في 2026 — يشير إلى شكل مختلف: Opus 5 في أواخر يوليو، وFable 5.1 في أوائل سبتمبر، واختبار رمادي لـ Opus 5.2 في منتصف سبتمبر. لم تشهد فئة Sonnet أي تحرك منذ 30 يونيو، وهذا تحديدًا هو سبب كون شائعة Sonnet معقولة، وهو تحديدًا سبب كونها غير مُتحقق منها. الفجوة الطويلة سبب لتوقع شيء ما، وليست دليلًا على وجود شيء محدد.

ما يمكنك تشغيله فعليًا اليوم

Claude Sonnet 5 ليس مجرد عنصر نائب تنتظر به. إنه النموذج الذي يعمل عليه معظم استخدام Claude بالفعل، وأرقامه ملموسة على نحو لا يتسم به أي شيء في شائعة 5.2.

Artificial Analysis model page for Claude Sonnet 5 showing an Intelligence Index of 32 at rank 8, 165 tokens per second output speed, 31.20 second time to first token, $2.00 input and $10.00 output per million tokens, a 1M token context window, 128k maximum output, a Coding Index of 51 and an Agentic Index of 36

• معرّف الطراز — claude-sonnet-5، قابل للاستدعاء الآن؛ أما Claude Sonnet 5.2 فلا يملك أي معرّف منشور من أي نوع

• السعر — $2 لكل مليون توكن إدخال و$10 لكل مليون توكن إخراج، وأصبح دائمًا في 10 أغسطس؛ ولم يعد السعر القياسي المخطط له $3 / $15 ساريًا. لا يُعرف شيء عن تسعير 5.2 لأنه لا يوجد شيء يُعرف

• السياق — نافذة بسعة 1M رمز مع حد أقصى للإخراج 128K. لا يذكر منشور Anthropic نفسه النافذة في صفحة الإطلاق؛ غير أن التفصيل الذي يُبرزه هو أداة الترميز المنقحة، وهو أهم مما يبدو: فقد يُقابَل المدخل المتطابق بنحو 1.0–1.35× عدد الرموز، تبعًا لنوع المحتوى.

• اختبارات معلنة من المورّد — SWE-bench Pro 63.2%، Terminal-Bench 2.1 بنسبة 80.4–80.5%، Humanity's Last Exam 43.2% بدون أدوات و57.4% معها، OSWorld-Verified 81.2%، GDPval-AA v2 عند 1,618. هذه أرقام Anthropic، غير مُعاد إنتاجها هنا

• مستقل — يضع Artificial Analysis نموذج Claude Sonnet 5 عند 32 على مؤشر Intelligence Index في تهيئته للاستدلال التكيّفي بأقصى جهد، وهو أعلى بكثير من الوسيط البالغ 24 لفئته السعرية، وعند 29 في تهيئة الجهد العالي غير الاستدلالي.

• التحذير المتعلق بالتكلفة الذي يبقى قائمًا بعد أي رقم إصدار — لم تتغيّر أسعار الرموز لدى Anthropic، لكن تحليلًا مستقلًا لمؤشر Intelligence Index وجد أن Sonnet 5 يستهلك رموز إخراج أكثر بنحو 30–40% لكل مهمة مقارنةً بسابقه، لأن التفكير التكيفي مُفعّل افتراضيًا. السعر المعلن ليس الفاتورة.

تلك النقطة الأخيرة هي التي يجب أن تأخذها معك إلى أي نقاش حول 5.2. إذا صدر تحديث لـ Sonnet، فإن الرقم المثير للاهتمام ليس السعر لكل مليون. بل عدد الرموز لكل مهمة، وما إذا كان مستوى الجهد الافتراضي الجديد يرفعه بهدوء مرة أخرى.

ما الذي سيتعيّن على Sonnet 5.2 تغييره ليُحدث فرقًا

ضع جانبًا مسألة ما إذا كان موجودًا. السؤال الأكثر فائدة هو ما الذي سيجعله يستحق التبديل إليه، لأن ذلك يحدد ما يجب مراقبته — ولا شيء من ذلك هو «إطلاق تحديث لـ Sonnet».

Comparison scoreboard for Claude Sonnet 5.2 and Claude Sonnet 5: the rumoured model's unconfirmed status, missing model ID, unknown price, absent benchmarks and single list entry against the live model's GA date of June 30, claude-sonnet-5 model ID, $2 / $10 per million tokens, and Artificial Analysis Intelligence Index of 32

لكي يكون Sonnet 5.2 ذا معنى، سيتعين عليه أن يحرّك واحدًا على الأقل من أربعة أمور. الأول هو الرموز لكل مهمة: نسخة تحافظ على معدل 2$ / 10$ لكنها توقف تضخم رموز المخرجات بنسبة 30–40% ستخفض الفواتير الفعلية أكثر مما يفعله خفض سعر معلن. والثاني هو الفجوة الوكيلية إلى الفئة الأعلى — فقد كان Sonnet 5 مُوضعًا باعتباره يقطع نحو تسعة أعشار الطريق إلى الرائد السابق في العمل الوكيلي بجزء ضئيل من التكلفة، وهذه النسبة هي ما يجعله الخيار الافتراضي. والثالث هو سلوك السياق الطويل الذي جعل المُرمِّز المنقّح التفكير فيه أكثر صعوبة. والرابع، وهو الأقل احتمالًا للإعلان، هو ما إذا كان 5.2 سيصل بصفته Sonnet أصلًا — فآخر مرة سمّى فيها المجتمع بثقة خليفة لـ Sonnet، كان النموذج الذي طُرح هو Fable.

ما لن يُعد خبرًا: ظهور نقطة حفظ في أداة تقييم، أو اسم رمزي في مستودع إطار عمل، أو تغريدة تجميعية أخرى. لا شيء من ذلك يغيّر ما يمكنك استدعاؤه، أو تكلفته، أو الدرجة التي يحققها.

كيف تتمركز دون المراهنة على ذلك

المشكلة العملية في تحديث طبقة غير موثّق ليست أنك قد تفوّته. بل إن الاستعداد له يعني عادةً عملاً ستستاء من القيام به مرتين — عقد مورّد ثانٍ، وتكامل SDK ثانٍ، ومجموعة ثانية من المفاتيح والحدود والفواتير.

هذا هو الجزء الذي يستحق الإزالة الآن بدلًا من لاحقًا. كان Claude Sonnet 5 متاحًا على OrcaRouter منذ يونيو بسعر Anthropic نفسه البالغ 2 دولار / 10 دولارات، ويُمرَّر بسعر قائمة المزوّد دون أي هامش ربح، لذا فإن أي تغيير في سعر المورّد على خط Sonnet سيكون ساريًا هنا في اليوم نفسه بدلًا من دورة الفوترة التالية.

OrcaRouter model page for anthropic/claude-sonnet-5, showing Claude Sonnet 5 listed at Anthropic's prices of $2.00 input and $10.00 output per million tokens with a 1M token context window, 128K maximum output, and an Artificial Analysis Intelligence Index of 32 at rank 8

المفتاح نفسه يصل بالفعل إلى بقية تشكيلة Claude الحالية وأكثر من 200 طراز آخر على المنصة، ما يعني أن وصول 5.2 لا يبدأ مشروع تكامل — بل يظهر في الكتالوج، وتوجّه شريحة من حركة المرور إليه مع وجود احتياطي إلى Claude Sonnet 5 بينما تكتشف ما إذا كانت حسابات الرموز لكل مهمة تنجح فعلاً في عبء عملك. التبديل التلقائي عند الفشل هو ما يجعل القيام بذلك آمناً مع طراز لم يقم أحد بقياس أدائه بمعايير مستقلة بعد.

بالنسبة لأي شخصٍ يعتمد نظامه التقني بالفعل على claude-sonnet-5، فإن الإجابة الصادقة على سؤال "هل ينبغي أن أنتظر Claude Sonnet 5.2" هي لا — فلا يوجد شيء تنتظره، ولا موعد، ولا سبب للاعتقاد بأن النموذج الحالي على وشك أن يتوقف عن كونه الخيار الافتراضي الصحيح. وما ينبغي فعله هو جعل الانتقال منخفض التكلفة، لا أن تجعله مبكرًا.

ما الذي سيحسم هذا؟

ثلاثة أشياء، بترتيب تنازلي حسب مقدار ما ستخبرك به. مُعرّف API سيكون حاسمًا، لأن النموذج الذي يتم تقديمه يجب أن يكون له اسم في الطلب، وهكذا أصبحت قصة Marshmallow وMelon قابلة للتحقق، وكذلك أصبحت تقارير توجيه Opus 5.2 قابلة للتحقق. إقرار البائع — بطاقة نموذج، صفحة توثيق، سطر في سجل التغييرات — سينهي الجدال تمامًا. تقرير مختبر خاص بطبقة معينة، مع وصف للسلوك بدلًا من اسم، سيكون الأضعف من بين الثلاثة ومع ذلك أكثر مما هو موجود اليوم.

حتى يظهر أحدها، فإن Claude Sonnet 5.2 ليس سوى اسم في قائمة. تعامل معه كمحفز للتحقق مما إذا كانت بنيتك التقنية قادرة على استيعاب تحديث Sonnet بتكلفة زهيدة، وليس كسبب للتخطيط بناءً عليه.