
Ember-1 مقابل Gemma 4 12B: أحدهما يؤجّر لك رموزًا أقل، والآخر يسلّمك الأوزان.
- openaiجديدOpenAI: GPT-6 Luna2026-09-2237الذكاء
- openaiجديدOpenAI: GPT-6 Sol2026-09-2248الذكاء
- anthropicجديدAnthropic: Claude Opus 5.52026-09-2258الذكاء
- grokجديدGrok 4.72026-09-2146الذكاء
- OrcaجديدOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 لكل مليون رمز · 177 tok/s
- orcaجديدOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 لكل مليون رمز · 1323 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040الذكاء
- openaiOpenAI: GPT-6 Astra2026-09-0453الذكاء77البرمجة
- googleGoogle: Gemini 3.8 Flash2026-09-0241الذكاء76البرمجة
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245الذكاء76البرمجة
- anthropicAnthropic: Claude Fable 5.12026-09-0153الذكاء82البرمجة
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 لكل مليون رمز · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642الذكاء72البرمجة
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 لكل مليون رمز · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845الذكاء75البرمجة
- obsidianQwen3.8 27B2026-08-1534الذكاء68البرمجة
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236الذكاء69البرمجة
- grokSpaceXAI: Grok 4.62026-08-1244الذكاء77البرمجة
- metaMeta: Muse Spark 1.22026-08-0540الذكاء72البرمجة
- qwenQwen: Qwen3.8 Max2026-08-0345الذكاء76البرمجة
Ember-1 وGemma 4 12B لا يتنافسان على البند نفسه في أمر الشراء، وأسرع طريقة لترى السبب هي أن تسأل عمّا ستملكه في نهاية كل شهر. Gemma 4 12B هو نموذج Google الكثيف متعدد الوسائط ذو 11.95 مليار معامل، صدر في 3 يونيو 2026 بموجب Apache 2.0 — تنزّله، وتصبح نقطة التحقق ملكك. أما Ember-1 فهو مشتق متخصص من إنتاج Fireworks Research عن Kimi K3 الخاص بـ Moonshot AI، نُشر في 23 سبتمبر 2026 كمعاينة بحثية على منصة المورّد الخالية من الخوادم — تستدعيه، ولا تملك شيئًا سوى الفاتورة. أحدهما جدال إيجار ينتهي بالتمليك حول التوكنات؛ والآخر شراء رأسمالي. ضعهما جنبًا إلى جنب، فالمقارنة المفيدة ليست أي النموذجين أفضل، لأنه لا شيء منشور يتيح لك حسم ذلك. بل أيّ من شكلي الشراء يناسب ما تبنيه.
العقدان، بصياغة واضحة
Gemma 4 12B هو إصدار مكتمل بأوزان مفتوحة. تنشر Google الأوزان، والبنية المعمارية، وجدول المعايير القياسية، والترخيص، ويشغّله مجتمع من بيئات التشغيل — llama.cpp، وvLLM، وMLX، وSGLang، وTransformers — على عتاد تتحكم به. تكلفة الرمز بعد الشراء هي الكهرباء والإطفاء، وليست بندًا على فاتورة مورّد. الأشياء التي تتخلى عنها هي ما تكلفه الأوزان المفتوحة دائمًا: أنت تملك تخطيط السعة، وسقف جودتك مثبّت عند 11.95 مليار معامل.
إن Ember-1 هو العكس. لا توجد أوزان لتنزيلها — فهو موجود كخيار خدمة على منصة المورّد نفسه — ولا سعر منشور. ما يقدّمه بدلاً من ذلك هو ادعاء أضيق، منفّذ فوق نموذج أكبر بكثير: دقة Kimi K3، مع إنفاق نحو 40% رموز أقل للوصول إلى ذلك. درّبته Fireworks Research تحديداً لتقصير مسارات الاستدلال دون تغيير الإجابات، وتقول إن طول الاستدلال يمكن خفضه بنسبة 35–50% دون خسارة في الدقة عبر سبعة معايير واختباري A/B لإنتاج العملاء. كل رقم هناك مُبلّغ عنه من المورّد وغير مُعاد إنتاجه.

تعتمد قيمة الحجة المتعلقة بالرموز بالكامل على من يدفع ثمن الرموز.
تفترض الرسالة الترويجية الخاصة بـ Ember-1 فاتورة لكل توكن. وهذا الافتراض صحيح بالنسبة للجمهور الذي صُمّمت من أجله — فرقٌ تشغّل حلقات وكلاء طويلة على نموذج حدودي مستضاف، حيث تشير Fireworks Research إلى أن Kimi K3 يمكن أن ينفق أكثر من 90% من التوكنات المولّدة على الاستدلال الداخلي، وحيث تعيد كل جولة تشغيل الجولات السابقة، فيُعاد قراءة الاستدلال الأسبق وتُعاد فوترته. في هذا السياق، يكون تقليص طول التتبع خفضًا مباشرًا في الفاتورة الشهرية، وتكون نتيجة اختبار A/B البالغة 29.9K من توكنات الإخراج مقابل 49.3K لدى K3 هي الرقم المهم.
شغّل النموذج نفسه على شروط Gemma 4 12B، فتتلاشى الحجة. عندما تستضيف ذاتيًا نقطة تحقق Apache-2.0، فإن رموز الاستدلال الإضافية تكلّف زمنًا فعليًا وإشغالًا لوحدة GPU، لا دولارات لكل مليون. أما أثر الاستدلال المسهب على حاسوبك المحمول بسعة 16GB فهو إجابة أبطأ، لا فاتورة أكبر. هذا لا يجعل عدم الكفاءة غير ضارة — ففي حلقة الوكيل تظل تتراكم، وتظل تظهر كزمن وصول — لكن سعر الصرف مختلف، والتعامل مع خفض بنسبة 40% في الرموز باعتباره توفيرًا بنسبة 40% على عتاد مستضاف ذاتيًا خطأ فئوي.
ورقة المواصفات، سطر واحد لكل بُعد
• ما هو — Ember-1: نسخة معاينة بحثية مشتقة من Kimi K3، أُعيد تدريبها لاستدلال أقصر. Gemma 4 12B: نموذج متعدد الوسائط مفتوح الأوزان وكثيف بحجم 11.95 مليار معلم من عائلة Gemma 4 التابعة لـ Google.
• الأوزان — Ember-1: لم يُنشر أي منها؛ يُقدَّم فقط عبر منصة المورّد. Gemma 4 12B: رخصة Apache 2.0، قابل للتنزيل، بدون قيود.
• الحجم — Ember-1: غير معلن؛ موروث من معمارية Kimi K3. Gemma 4 12B: 11.95B كثيف، 48 طبقة، حوالي 18GB من الأوزان بتنسيق BF16.
• نافذة السياق — Ember-1: لم تُنشر للمعاينة؛ يحمل نموذجها الأساسي 1,048,576 رمزًا. Gemma 4 12B: 256 ألف رمز.
• المدخلات — Ember-1: نص. Gemma 4 12B: نص وصورة وصوت عبر تصميم موحّد خالٍ من المُرمِّز، مع إدراج الفيديو من قِبل بعض المصادر.
• السعر — Ember-1: لم يُنشر أي سعر؛ الدولارات في ورقة القياس محسوبة من بطاقة أسعار Kimi K3. Gemma 4 12B: مجاني للتنزيل؛ أنت تدفع ثمن العتاد.
• الحد الأدنى للعتاد — Ember-1: أيًا كان ما يحدده المورّد. Gemma 4 12B: 16GB من VRAM أو ذاكرة موحّدة، وفقًا لتوصيف Google.
• الأدلة — Ember-1: مقاييس أداء من المورّد واختبارا A/B أجراهما المورّد، لم يُعَد إنتاجهما. Gemma 4 12B: تقييمات أبلغت عنها Google إضافة إلى منظومة مستقلة من التشغيلات المحلية.
ما الذي تنشره Gemma 4 12B، وكيف تقرأ
أرقام Google نفسها الخاصة بـ Gemma 4 12B تضعه بين Gemma 4 E4B بحجم الأجهزة الطرفية ونموذج 26B MoE الأكبر: GPQA Diamond 78.8%، وMMLU Pro 77.2%، وAIME 2026 بدون أدوات 77.5%، وLiveCodeBench v6 72.0، وCodeforces ELO 1659، ومتوسط τ-2 69.0%، وMMMU Pro 69.1%، وDocVQA 94.9، وBigBench Extra Hard 53.0%. هذه أيضًا مُبلَّغ عنها من المورّد — فقد قيّمت Google نموذجها الخاص ونشرت ورقة النتائج — لكن ميزتها أنها تصف نقطة تفتيش يمكن لأي شخص تنزيلها وإعادة تشغيلها، ولهذا تميل ادعاءات الأوزان المفتوحة إلى نيل تأكيد طرف ثالث بسرعة، بينما لا تفعل ادعاءات المعاينة المغلقة ذلك.
التمييز الفعلي لهذا الطراز بنيوي وليس عدديًا. لا يمتلك Gemma 4 12B مشفّرًا منفصلًا للرؤية أو الصوت: إذ تُسقَط رقع الصور والموجات الصوتية مباشرةً في فضاء الرموز، وهذا ما يسمح لطراز 12B بأن يتلقى لقطة شاشة أو تسجيلًا كمدخل أصلًا. كما يأتي مزوّدًا بمُعِدّي مسودّات التنبؤ متعدد الرموز من أجل الفك التخميني، وهي ميزة تتعلق بزمن الاستجابة لا بالجودة — من النوع الذي يهم عندما تشغّل الطراز بنفسك وتكون كل مللي ثانية من التعبئة الأولية على حسابك.
حيث يتصادم الاثنان فعليًا
كلا الطرازين يُسوَّقان في البرمجة الوكيلية واستخدام الأدوات، وهذا هو المجال الوحيد الذي يوجد فيه خيار حقيقي. رقم Ember-1 في Terminal Bench 2.1 هو 82.0% مقابل 80.9% لـ Kimi K3 Max، مع عدد رموز أقل بنسبة 51.9%؛ ونتيجته في SWE-bench Verified هي 92.2% مقابل 93.2% لـ K3 Max. لا يملك Gemma 4 12B أي رقم لـ Terminal Bench أو SWE-bench في مجموعة Google المنشورة على الإطلاق — ودليله الوكيلي هو τ-2 عند 69.0%. لذا لا يمكنك مقارنتهما على معيار مشترك، وأي مقال يفعل ذلك إنما يختلق المقارنة.
ما يمكنك قوله هو أنهما يقعان عند نقطتين مختلفتين على منحنى التكلفة. إذا كان حمل عمل وكيلك يعمل مقابل نموذج رائد مستضاف وتكون الفاتورة في معظمها من رموز الاستدلال، فإن Ember-1 يستهدف هذا البند تحديدًا — مقابل نافذة وصول مدتها أسبوعان ولا سعر معلن. وإذا كان حمل عملك يحتاج إلى العمل على عتاد تتحكم به، أو التعامل مع لقطة شاشة، أو الصمود أمام قرار بائع بعدم متابعة إصدار تجريبي، فإن Gemma 4 12B هو الوحيد من بين الاثنين الذي يجيب عن السؤال أصلًا.

طريق وسط، وأين نجده
هناك خيار ثالث لا يقوم عليه تسويق أي من النموذجين نفسه: استخدام فئتي Gemma 4 الأكبر كنصف مُستضاف في حل هجين. يوجّه OrcaRouter طراز Gemma 4 26B-A4B من Google وGemma 4 31B إلى جانب أكثر من 200 نموذج آخر خلف واجهة برمجة تطبيقات واحدة بسعر قائمة المزوّد وبهامش ربح 0%، بحيث يصل المفتاح نفسه الذي يصل إلى Gemma متوسطة الحجم أيضًا إلى النماذج المتقدمة التي كنت ستحتاج إلى عقد ثانٍ للحصول عليها. أما Gemma 4 12B نفسه فليس على منصتنا، ولا Ember-1 كذلك — إن كنت بحاجة إلى 12B محليًا، فقم بتنزيله؛ وإن أردت أن تختبر أولًا ما إذا كان Gemma أكبر يسدّ الفجوة، فإن هذا الاختبار يكلّف نقطة نهاية واحدة.
هذا الترتيب هو أيضًا الطريقة الصادقة لتقييم معاينة بحثية. التبديل التلقائي عند الفشل بين المزوّدين يعني أن نموذجًا يختفي من نافذة المعاينة لا يأخذ تطبيقك معه، وهو الخطر المحدد الذي تطرحه حالة إصدار Ember-1 والخطر المحدد الذي لا يعالجه أي شيء في جدول القياسات المرجعية الخاص به.
أي منها ينتمي إلى خارطة طريقك؟
اختر Gemma 4 12B إذا كانت الملكية مطلبًا — الخصوصية، أو التشغيل دون اتصال، أو حدّ تكلفة ثابت، أو منتج يجب أن يظل يعمل إذا غيّر أحد المورّدين رأيه. فسقفه المعلن أدنى من سقف نموذج مشتق من الحدود المتقدمة، ومدخلاته متعددة الوسائط تمثل تمايزًا حقيقيًا، ولا تعتمد أي من هاتين الحقيقتين على خارطة طريق أي جهة أخرى.
اختر Ember-1 إذا كانت مشكلتك تتعلق بفاتورة لكل رمز في تشغيلات الوكلاء الطويلة، ويمكنك تحمّل مخاطر الإصدار التجريبي. شغّله في وضع الظل مقابل نظامك الحالي خلال الأسبوعين المتاحين لك، وقِس عدد الرموز لكل مهمة مكتملة على حركة المرور الخاصة بك، وتعامل مع نسبة 40% كفرضية لا كمعدل. ما لا ينبغي أن تفعله هو المفاضلة بينهما على أساس الجودة، لأنه لا أحد — بما في ذلك المختبر الذي بنى Ember-1 — قد نشر مقارنة تتيح لك ذلك.

النقطة الأكبر هي أنّ هذين الإصدارين يمثّلان الطريقتين اللتين تُباع بهما القدرات في أواخر عام 2026. أحد المختبرات ينشر نقطة تحقق ويترك المنظومة البيئية تجد مستواها؛ وآخر يأخذ نموذجًا درّبه شخص آخر، ويحسّن محورًا واحدًا من سلوكه، ويبيع التحسين كخدمة. كلاهما مشروع، وكلاهما يفشل بطرق مختلفة: الأوزان المفتوحة تفشل ببطء وعلى الملأ، والمعاينات تفشل فجأة وبإعلان.
مقارنات في هذه المقالة1
مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا
