
Laguna S 2.1: نموذج الترميز مفتوح الوزن من Poolside الذي يتفوق بكثير على ما يوحي به حجمه (وسعره)
- qwenجديدQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 لكل مليون رمز
- orcaجديدOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicجديدAnthropic: Claude Opus 52026-07-2461الذكاء78البرمجة
- googleجديدGoogle: Gemini 3.6 Flash2026-07-2150الذكاء69البرمجة
- googleجديدGoogle: Gemini 3.5 Flash-Lite2026-07-2137الذكاء49البرمجة
- metaجديدMeta: Muse Spark 1.12026-07-1651الذكاء71البرمجة
- kimiMoonshotAI: Kimi K32026-07-1557الذكاء76البرمجة
- openaiOpenAI: GPT-5.6 Luna2026-07-0951الذكاء71البرمجة
- openaiOpenAI: GPT-5.6 Terra2026-07-0955الذكاء77البرمجة
- openaiOpenAI: GPT-5.6 Sol2026-07-0959الذكاء77البرمجة
- grokxAI: Grok 4.52026-07-0854الذكاء72البرمجة
- tencentTencent: Hy32026-07-0641الذكاء59البرمجة
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232الذكاء42البرمجة
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226الذكاء39البرمجة
- anthropicAnthropic: Claude Sonnet 52026-06-3053الذكاء72البرمجة
- klingKling: Kling 3.0 Turbo2026-06-1757الذكاء52البرمجة57الرياضيات
- z-aiZ.ai: GLM 5.22026-06-1651الذكاء69البرمجة60الرياضيات
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242الذكاء61البرمجة61الرياضيات
- anthropicAnthropic: Claude Fable 52026-06-0960الذكاء77البرمجة
- qwenQwen: Qwen3.7 Plus2026-06-0139الذكاء56البرمجة59الرياضيات
في 21 يوليو 2026، أصدرت Poolside Laguna S 2.1 — وهو نموذج برمجة مفتوح الوزن يضم 118 مليار معلمة، مع حوالي 8 مليار معلمة نشطة فقط لكل رمز — وقد طرحته باعتباره "النموذج مفتوح الوزن الأكثر قدرة في الغرب" وردًا على DeepSeek وQwen. العنوان الرئيسي ليس أنه يتفوق على كل نظام متقدم مغلق؛ بل أنه يتفوق على نماذج أكبر بعدة مرات منه في معايير البرمجة الوكيلة بتكلفة تبلغ 0.10 دولار / 0.20 دولار لكل مليون رمز. يغطي هذا الدليل ما هو Laguna S 2.1 فعليًا، وطريقة تفكيره، وما يتم الإبلاغ عنه بشكل مستقل مقابل ما يقدمه البائع، وما تكلفته، وكيفية تشغيله، ومن يجب أن يستخدمه.
كل شكل أدناه مُصنَّف حسب المصدر. النتائج الرئيسية لـ Laguna مُبلَّغ عنها من Poolside (من مواد إطلاقها وبطاقة Hugging Face) ما لم يُذكر طرف ثالث مُسَمَّى؛ تعامل معها على أنها مُدارة من البائع حتى تؤكد مختبرات مستقلة. المؤشرات والأسعار تتغير — تحقق قبل أن تلتزم بميزانية.
خلاصة. Laguna S 2.1 هو نموذج برمجة مفتوح الأوزان، يعتمد على MoE (118B إجمالي / ~8B نشط) مع سياق يصل إلى 1M ومفتاح "تفكير / لا تفكير"، بسعر 0.10 دولار للإدخال / 0.20 دولار للإخراج لكل 1M رمز — وهو جزء بسيط من معظم المنافسين. Poolside تبلغ عن 78.5% في SWE-Bench Multilingual (ريادة النماذج المفتوحة ذات الحجم المعلن)، و70.2% في Terminal-Bench 2.1، و40.4% في DeepSWE v1.1 (مقابل 9.0% في DeepSeek-V4-Pro-Max) — بحوالي سدس المعلمات النشطة. إنه أفضل خيار برمجة لكل دولار في النماذج مفتوحة الأوزان رأيناه، لكن النماذج الرائدة المغلقة مثل Claude Fable 5، Claude Opus 5، وKimi K3 لا تزال تتصدر في عدة معايير مطلقة. إذا كنت تريد مبرمجًا رخيصًا يمكن استضافته ذاتيًا ويتفوق على فئة وزنه، فإن Laguna S 2.1 هو الخيار؛ وإذا كنت بحاجة إلى أعلى دقة برمجة مطلقة، فإن النموذج الرائد لا يزال هو الفائز.
النقاط الرئيسية
• أفضل برمجة مفتوحة الوزن مقابل كل دولار. 0.10 دولار / 0.20 دولار لكل 1 مليون رمز لنموذج يتصدر النماذج المفتوحة المفصح عن حجمها في SWE-Bench Multilingual (78.5%).
• يتفوق على حجمه. حوالي 8 مليار معلمة نشطة، لكنه يتفوق أو يعادل نماذج أكبر بكثير على Terminal-Bench 2.1 و SWE-Bench Pro.
• أوزان مفتوحة وقابلة للاستضافة الذاتية. الأوزان على Hugging Face (poolside/Laguna-S-2.1) — يمكنك تشغيلها في بيئتك الخاصة.
• وضع التفكير يُحرّك النتائج. يرفع التفكير الأقصى DeepSWE من 16.5% إلى 40.4% — قوي، لكنه يستهلك رموز الاستدلال، لذا خصص ميزانية له.
• ليس في المرتبة الأولى المطلقة. لا تزال النماذج الرائدة المغلقة في المجال (Fable 5, Opus 5, Kimi K3) تتصدر العديد من معايير البرمجة المطلقة؛ ادعاء Laguna يتعلق بفئة الوزن والسعر، وليس قمة اللوحة.
ملاحظة حول قراءة هذا الموجز: كل ما يُنسب إلى Poolside هو ادعاء من جهة البائع من مواد الإطلاق؛ حيثما يكون المعيار مستقلاً، نذكر المصدر. وحيثما لا يُنشر درجة ذكاء عام مستقلة، نقول ذلك بدلاً من التخمين — Laguna متخصص في البرمجة، وليس متصدرًا في لوحات القيادة للأغراض العامة.
ما هو Laguna S 2.1 في الواقع
Laguna S 2.1 هو نموذج برمجة وكيل مفتوح الأوزان من Poolside. من الناحية المعمارية، هو مزيج من الخبراء: 118 مليار معامل إجمالاً ولكن يتم تنشيط حوالي 8 مليارات فقط لكل توكن، وهذا هو سبب انخفاض تكلفة تشغيله مقارنة بقدراته. يدعم سياقًا يصل إلى مليون توكن ووضعين للتشغيل — مسار سريع "بدون تفكير" ومسار "تفكير" ينفق رموز استدلال إضافية للمشاكل الأصعب. وهو مصمم للبرمجة والعمل الوكيل: استخدام الأدوات، استدعاء الدوال، المهام متعددة الخطوات. كما تصدر Poolside نموذجًا أصغر، Laguna XS 2.1 (33 مليار إجمالاً / ~3 مليار نشط)، بسعر أقل يبلغ $0.06 / $0.12.
الأمر الحاسم هو أن الأوزان مفتوحة ومنشورة على Hugging Face، لذلك على عكس نموذج API المغلق، يمكنك تنزيل Laguna S 2.1، وتشغيله على البنية التحتية الخاصة بك، وضبطه بدقة، وتثبيت إصدار. هذا المزيج — البرمجة القريبة من الحدود الأمامية، عدد المعلمات النشطة الصغير جدًا، الأوزان المفتوحة، والسعر المنخفض جدًا — هو الفكرة الكاملة، ولهذا السبب تصفها Poolside بأنها إجابة الغرب على النماذج المفتوحة القوية من DeepSeek وQwen.
ما الجديد: المعايير
الأرقام المتعلقة بالإطلاق تدور حول البرمجة. في اختبار SWE-Bench Multilingual، تبلغ نسبة Poolside 78.5%، والتي تقول إنها تتصدر النماذج المفتوحة ذات الحجم المعلن. في Terminal-Bench 2.1 تحصل على 70.2%. وفي DeepSWE v1.1 تصل إلى 40.4% — وأكثر مقارنة Poolside إثارة هي أن هذا يتفوق على نسبة DeepSeek-V4-Pro-Max البالغة 9.0% في نفس الاختبار بحوالي سدس المعلمات النشطة. في Terminal-Bench 2.1 وSWE-Bench Pro، تقول Poolside إن Laguna S 2.1 تطابق أو تتجاوز نماذج أكبر بعدة مرات منها، بما في ذلك DeepSeek V4 Flash، وNemotron 3 Ultra من NVIDIA، وInkling من Thinking Machines.
الإطار الصادق الذي يستخدمه Poolside نفسه يتعلق بفئة الوزن، لا بالتفوق المطلق: فالنماذج الحدودية المغلقة مثل Claude Fable 5 وKimi K3 لا تزال تتصدر في عدة معايير. لذا فإن الطريقة الصحيحة لقراءة Laguna S 2.1 هي "أكبر قدر من القدرات يمكنك الحصول عليه من نموذج مفتوح، نشط بحوالي 8B، ورخيص جدًا"، وليس "أفضل مبرمج على الإطلاق".

Thinking mode: where the performance comes from
يتركز أداء Lagrange S 2.1 في النتائج البارزة على وضع "التفكير الأقصى". وأوضح مثال على ذلك هو DeepSWE v1.1، حيث يقفز المعدل من 16.5% بدون تفكير إلى 40.4% مع التفكير الأقصى — أي أن معظم قوة النموذج في المعايير تأتي من السماح له بالاستدلال. يُظهر Terminal-Bench 2.1 نفس النمط (60.4% → 70.2%). هذا الأمر مهم للتكلفة وزمن الاستجابة: وضع التفكير يستهلك رموز استدلال إضافية، لذا بينما يكون سعر الرمز الواحد ضئيلاً، فإن المهمة الصعبة التي تُجرى بأقصى تفكير تستهلك رموزاً أكثر (وتستغرق وقتاً أطول) من المسار بدون تفكير. عملياً، ستُجرى الإكمالات الروتينية في وضع عدم التفكير من أجل السرعة والتكلفة، وتتحول إلى التفكير فقط عند المشكلات الصعبة متعددة الخطوات التي تستحق القفزة في الدقة استهلاك الرموز — وهو صدى خاص بالبرمجة لأقراص الجهد التي تظهر على النماذج الحدودية.
الغوص العميق في المعيار: ما تقيسه اختبارات البرمجة هذه
SWE-Bench Multilingualيوسع نطاق أداة SWE-bench المعروفة (التي تحل مشكلات GitHub الحقيقية) عبر لغات برمجة متعددة، لذا فإن 78.5% هو مؤشر قوي على إصلاح الأخطاء العملي عبر اللغات — وأن "يقود النماذج ذات الحجم المكشوف المفتوح" هو ادعاء ذو معنى، وإن كان مذكورًا من قبل البائع.Terminal-Bench 2.1يختبر ما إذا كان النموذج يمكنه تشغيل محطة طرفية حقيقية لإكمال المهام من البداية إلى النهاية، وهو أقرب إلى ما يفعله وكيل البرمجة المستقل فعليًا مقارنة بإكمال الكود من مرة واحدة.DeepSWE v1.1هي مجموعة برمجيات هندسية وكيلية أصعب؛ نسبة 40.4% (مقابل 9.0% لـ DeepSeek-V4-Pro-Max) هي الرقم الأكثر لفتًا من Laguna على وجه التحديد لأنها فجوة كبيرة مقابل نموذج أكبر بكثير.
التحذير الذي يبقي هذا الأمر صادقًا: هذه نتائج تشغيل من Poolside وقت الإطلاق، ولا يوجد مؤشر Artificial Analysis Intelligence Index منشور أو رقم مستقل لـ SWE-bench Verified لـ Laguna S 2.1 حتى الآن. لذا تعامل مع ادعاءات القيادة كمبلغ عنها من قبل البائع حتى يؤكدها طرف ثالث، وتذكر أن Laguna متخصصة في البرمجة — فهي ليست في موقع قائد التفكير العام، ولا ينبغي أن تتوقع منها أن تتصدر مؤشر الذكاء العام.

ما تكلفته عمليًا
هذا هو المكان الذي تعطل فيه Laguna S 2.1 بشكل حقيقي. بسعر 0.10 دولار للإدخال / 0.20 دولار للإخراج لكل مليون رمز، فإن استدعاء برمجي نموذجي مكون من 15000 رمز إدخال و 3000 رمز إخراج يكلف 15000 × 0.10 دولار/1M + 3000 × 0.20 دولار/1M = 0.0015 دولار + 0.0006 دولار = حوالي 0.0021 دولار — أي ما يقرب من خمس السنت. نفس الاستدعاء على نموذج حدودي مثل Claude Opus 5 (5 دولار / 25 دولار) يكلف حوالي 0.15 دولار — أي ما يقرب من 70 ضعفًا. حتى بالمقارنة مع المنافسين الرخيصين، فإن Laguna تقلل السعر: فهي أقل من تسعير DeepSeek. العلامة النجمية هي وضع التفكير — فقد تؤدي مهمة صعبة بأقصى تفكير إلى توليد عدة أضعاف رموز الإخراج، لذلك قد يتحول استدعاء بقيمة 0.0006 دولار إلى بضعة سنتات. ولكن حتى مع التضخيم، فإن التكلفة تعتبر خطأ تقريبًا بجوار النماذج الحدودية المغلقة. بالنسبة لأتمتة البرمجة عالية الحجم — بوتات التكامل المستمر، إعادة الهيكلة الجماعية، أساطيل الوكلاء — يصعب الجدال مع الاقتصاديات، خاصة أنه يمكنك أيضًا الاستضافة الذاتية لإزالة التكلفة لكل رمز بالكامل.
كيفية الوصول إلى Laguna S 2.1 وتشغيلها
نظرًا لأن الأوزان مفتوحة، أمامك مساران. يمكنك استدعاؤها عبر مزودي الخدمة المُستضافة (تظهر على مجمعات مثل OpenRouter) بسعر 0.10$/0.20$، وهي أسرع طريقة لتجربتها. أو يمكنك تنزيل الأوزان من Hugging Face (poolside/Laguna-S-2.1) واستضافتها بنفسك — مع الاحتفاظ بالشفرة والبيانات في بيئتك، وضبطها الدقيق على مستودعاتك، وقياسها لعتادك، والحد من التكلفة وفق بنيتك التحتية. البديل XS (33B-A3B) هو الخيار عندما تريد تشغيل شيء أصغر وأرخص محليًا. على أي حال، فهي تتيح استخدام الأدوات واستدعاء الوظائف، لذلك تندمج في أدوات الترميز الوكيلة.
لمن هذا: ثلاثة سيناريوهات
1. أتمتة الترميز عالية الحجم بميزانية محدودة
إذا كنت تدير روبوتات إصلاح CI، أو ترحيلات ضخمة، أو أساطيل وكلاء كبيرة حيث تتضاعف تكلفة الرموز، فإن سعر Laguna S 2.1 تحويلي — استخدم وضع "no-thinking" للأعمال الروتينية و"thinking" للحالات الصعبة. هذه هي أقوى حالة استخدام له.
2. الفرق التي يجب أن تستضيف نماذج الكود بنفسها
بالنسبة للمؤسسات التي لا تستطيع إرسال كود خاص إلى واجهة برمجة تطبيقات مغلقة، فإن وجود مبرمج مفتوح الأوزان يتصدر فئة حجمه هو بالضبط ما كان مفقودًا. يمنحك Laguna S 2.1 (أو XS للأجهزة الأصغر) برمجة مجاورة للحدود يمكنك التحكم الكامل بها.
3. الشركات الناشئة الحساسة للتكلفة التي تبني منتجات برمجية
إذا كانت هوامش منتجك تعتمد على تكلفة الاستدلال، فإن Laguna تتيح لك تقديم ميزات البرمجة بالذكاء الاصطناعي بجزء صغير من أسعار النماذج frontier — مع تخصيص النموذج frontier الرائد فقط لأصعب الطلبات التي يواجهها مستخدموك.

متى لا تستخدمه
لا تلجأ إلى Laguna S 2.1 عندما تحتاج إلى أفضل دقة ترميز مطلقة ويمكنك دفع ثمنها — فالنماذج الحدودية المغلقة (Fable 5 بنسبة 95.0% في SWE-bench Verified، وOpus 5 في المرتبة #1 في المؤشر العام، وKimi K3 في المرتبة #1 في Frontend Coding Arena) لا تزال تتصدر عدة معايير. لا تستخدمه في التفكير العام، أو المهام متعددة الوسائط، أو غير البرمجية — فهو متخصص في البرمجة دون خلفية ذكاء عام. ولا تفترض أن الأرقام البارزة تظل صحيحة في وضع عدم التفكير؛ إذا عطّلت التفكير لتقليل التكلفة، فاختبر الدرجات الأدنى التي ستحصل عليها فعليًا.
قائمة تدقيق القرار
• اختر Laguna S 2.1 إذا: كنت تريد أرخص مبرمج مفتوح الوزن قادر، يجب عليك الاستضافة الذاتية، أو تدير أتمتة برمجة عالية الحجم حيث التكلفة هي المسيطرة.
• اختر إحدى الطرازات الرائدة بدلاً من ذلك إذا كنت بحاجة إلى أعلى دقة في الترميز، أو التفكير العام، أو متعدد الوسائط — وبوسعك تحمّل تكلفتها.
• قم بتشغيل كلاهما إذا: الترميز الروتيني الافتراضي إلى Laguna وتصعيد المهام الأصعب إلى نموذج متقدم، خلف نقطة نهاية واحدة.
الأسئلة الشائعة
كم تكلفة Laguna S 2.1؟
0.10 دولار لكل مليون رمز إدخال و0.20 دولار لكل مليون رمز إخراج — مع نسخة أصغر Laguna XS 2.1 بسعر 0.06 / 0.12 دولار. إنه أحد أرخص نماذج البرمجة القادرة المتاحة، وبفضل كونه مفتوح الأوزان يمكنك استضافته بنفسك للتخلص من التكلفة لكل رمز. [OpenRouter/BenchLM]
هل Laguna S 2.1 مفتوح المصدر؟
إنه مفتوح الأوزان: تم نشر أوزان النموذج على Hugging Face (poolside/Laguna-S-2.1)، لذا يمكنك تنزيله وتشغيله وضبطه بدقة. تحقق من ترخيص Poolside لاستخدامك المحدد.
هل هو أفضل من DeepSeek أو Qwen للبرمجة؟
يضع Poolside نفسه كالرد الغربي عليهم، ويذكر تفوقه على DeepSeek-V4-Pro-Max في اختبار DeepSWE (40.4% مقابل 9.0%) بعدد أقل بكثير من المعاملات النشطة. وفي معايير البرمجة المفتوحة ذات الحجم المعلن، يتصدر حسب Poolside — لكن هذه المعايير يديرها البائعون، لذا تحقق بنفسك على مستودعاتك الخاصة.
هل يتفوق على النماذج الحدودية؟
ليس بشكل مطلق. لا تزال النماذج الرائدة المغلقة مثل Claude Fable 5 وClaude Opus 5 وKimi K3 تتصدر عدة معايير مطلقة. ادعاء Laguna هو الأفضل في فئة الوزن والأفضل من حيث القيمة مقابل المال، وليس الأفضل بشكل عام.
ما هو وضع التفكير؟
تبديل بين مسار سريع بدون تفكير ومسار أقصى التفكير ينفق رموز استدلال إضافية للحصول على دقة أعلى (مثل DeepSWE 16.5% ← 40.4%). استخدم بدون تفكير للعمل الروتيني، والتفكير للمهام الصعبة.
ما هي نافذة السياق؟
حتى 1M رمز، لذا فإن قواعد الأكواد الكبيرة ونصوص الوكلاء الطويلة مناسبة.
هل يجب أن أستخدم S أم XS؟
Laguna S 2.1 (118B/8B) {{1}}للترميز الأقوى{{/1}}; {{2}}Laguna XS 2.1 (33B/3B){{/2}} {{3}}عندما تريد شيئاً أصغر وأرخص للاستضافة الذاتية أو الخدمة بحجم كبير جداً.{{/3}}
خلاصة القول
لاجونا إس 2.1 هو نموذج الترميز مفتوح الوزن الأكثر إقناعًا في فئته حتى الآن: نموذج MoE بحجم 118 مليار/8 مليار مع سياق يصل إلى 1 مليون ومفتاح تفكير، بسعر ملحوظ قدره 0.10 دولار / 0.20 دولار، والذي تقول Poolside إنه يتفوق على النماذج مفتوحة الحجم المُعلن عنه في SWE-Bench Multilingual (78.5%) ويهزم منافسين أكبر بكثير في اختبارات الترميز العاملة. إنه ليس أفضل مبرمج مطلقًا — فلا تزال النماذج الرائدة المغلقة تتصدر عدة معايير — وتعتمد درجاته الرئيسية على وضع التفكير، الذي يستهلك الرموز. ولكن بالنسبة للترميز الرخيص والقابل للاستضافة الذاتية وعالي الحجم، لا يوجد شيء في فئة وزنه ينافسه. قم بتوجيه Laguna S 2.1 جنبًا إلى جنب مع كل نموذج رائد مغلق من خلال نقطة نهاية متوافقة مع OpenAI على OrcaRouter وأرسل إليه الجزء الأكبر من حركة الترميز الخاصة بك، مع تصعيد المهام الأصعب فقط.
