بطاقة عنوان رئيسي لـ «Ling 3.0 Tiny مقابل Gemini 3.5 Flash-Lite» مع العنوان الفرعي «المجاني ليس رخيصًا — لا يزال الحالي هو الخيار الآمن» وبطاقتا إحصائيات: Ling 3.0 Tiny (مؤشر AA 23، مطوّل جدًا، مجاني حتى 14 أغسطس) وGemini 3.5 Flash-Lite (مؤشر AA 36، ~490 رمزًا/ثانية، $0.30 / $2.50). شعار OrcaRouter مركّب في الركن السفلي الأيمن.
Guides & Insights

Ling 3.0 Tiny مقابل Gemini 3.5 Flash-Lite: المجاني ليس رخيصًا، والمنافس الحالي لا يزال الخيار الآمن

الكاتب

Jim Song

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

"مجاني" هي أغلى كلمة في مفردات سوق النماذج، لأنها عادةً تعني أن شخصًا ما على وشك أن يفرض عليك رسومًا مقابل شيء آخر غير السعر المعلن. هذا هو الفخ المختبئ في المواجهة بين Ling 3.0 Tiny، نموذج التفكير MoE الجديد من Ant Group InclusionAI الذي يضم 7.9 مليار معامل، وGemini 3.5 Flash-Lite، أرخص مستويات Ge​mini الحالية وأسرعها من Go​ogle. إن Ling 3.0 Tiny مجاني للاستدعاء الآن ويكلف $0.06 / $0.18 لكل مليون رمز بعد عرضه الترويجي في 14 أغسطس — لكن Artificial Analysis قاسه وهو يحرق 210M رمز إخراج فقط لتقييم فئته المكونة من 56 نموذجًا، مقابل متوسط 63M، ووصفه بأنه "كثير الكلام". بينما يكلف Gemini 3.5 Flash-Lite خمسة أضعاف السعر لكل رمز، أي $0.30 / $2.50، ومع ذلك يحمل مؤشر ذكاء مستقل قيمته 36 — أي أعلى بـ13 نقطة من Ling 3.0 Tiny — وسرعة إخراج تبلغ حوالي 490 رمزًا في الثانية. السعر الأرخص، والكلام الأسرع، والنتيجة الأدنى كلها لنفس النموذج. هذه هي القصة الكاملة لهذه المقارنة، والسبب الكامل للتفكير مرتين قبل أن تختار الوافد الجديد اعتمادًا على السعر وحده.

{{1}}يعيش كلا النموذجين في الفئة الاقتصادية، لكنهما في نقاط مختلفة من دورة حياتهما.{{/1}} Gemini 3.5 Flash-Lite هو النموذج الراسخ الناضج: أُطلق في 21 يوليو 2026، وتُعيد جهة خارجية قياسه باستمرار، وهو مُنتشر على نطاق واسع كفئة افتراضية للعمل الوكيل عالي الحجم والحساس لزمن الاستجابة. {{2}}Ling 3.0 Tiny يبلغ من العمر أسبوعًا، ومُسعّر لجذب المستخدمين، وحصل على تقييم مرة واحدة فقط.{{/2}} يفصل هذا المقال ما هو كل نموذج فعليًا، وما تقوله الأرقام المستقلة، ولماذا يُعد السعر «المجاني» أقل رقم مفيد في المقارنة.

Ling 3.0 Tiny، الوافد الجديد ذو عداد

Ling 3.0 Tiny launched on August 6, 2026 on commercial APIs with a quiet-listing pattern rather than a launch event. It is a mixture-of-experts model with 7.9B total parameters and roughly 1.3B active per token, a 256K-token context window (listed as 262K on the commercial listings and Artificial Analysis), up to 32K output tokens, native function calling, and prompt caching. Two modes switch per request: "Thinking," on by default, which spends output tokens on extended reasoning, and "Instant," which answers directly. It is text-in, text-out — no image, audio, or video input.

The pricing structure deserves precision, because "free" is doing a lot of work. It is listed as inclusionai/ling-3.0-tiny:free at $0 per million tokens on both sides; a second gateway runs it free until 8:00am PT on August 14, 2026, then applies its listed rate of $0.06 per million input and $0.18 per million output tokens, with cached input at $0.01. Artificial Analysis, which sampled the free tier, shows the $0.00 / $0.00 price on its live page. So the model is genuinely free right now, and genuinely metered a week from now.

Screenshot of the Artificial Analysis page for Ling 3.0 Tiny, showing an Intelligence Index of 23, price $0.00 / $0.00 on the free tier, a 210M-token verbosity read versus a 63M median, and output speed listed as N/A. REUSED from the what-is-ling-3-0-tiny explainer (audited).

جيميني 3.5 فلاش-لايت، الحالي

جيميني 3.5 فلاش-لايت هو إجابة Go​ogle على السؤال نفسه، مُقدَّم في درجة أقل ضمن سلسلة جيميني 3.5. وهو متعدد الوسائط بشكل أصلي على مستوى الإدخال — نص، صور، فيديو، صوت، وملفات — مع إخراج نصي، ونافذة سياق من 1M رمز، وما يصل إلى 64 ألف رمز إخراج، وجهد استدلال قابل للضبط (أدنى، منخفض، أعلى) بحيث يمكن لخط الأنابيب ضبط العمق والفاتورة لكل طلب. نتيجته المستقلة قفزة جيلية حقيقية: مؤشر الذكاء التحليلي الاصطناعي 36، ليحتل المرتبة 12 من بين 151 نموذجًا مُتتبعًا، مرتفعًا من 25 لنموذج جيميني 3.1 فلاش-لايت. أما على صعيد السرعة فهو الأسرع ضمن سلسلة 3.5 — حيث ذكرت Go​ogle 350 رمز إخراج في الثانية عند الإطلاق، وقد قاست الصفحة الحية لـ AA حوالي 490 رمزًا في الثانية، محتلاً المرتبة الثانية بين النماذج المُتتبعة. أرقامه الوكيلة المبلغ عنها من البائع — 74.0% في OSWorld-Verified، و54% في Terminal-Bench 2.1، و72.2% في اختبار استرجاع متعدد الإبر 128K — هي أرقام Go​ogle الخاصة وتوجيهية وليست قطعية، وهناك سؤال مفتوح (استخدام الكمبيوتر مُدرج كمدمج بشكل أصلي في مدونة Go​ogle لكنه غير مدعوم في وثائق API) يستحق التحقق قبل الاعتماد عليه.

كما أنها ليست رخيصة لكل توكن بالنسبة لفئتها. اسم "Lite" يصف مكانة النموذج في التشكيلة، لا انخفاض السعر المعلن: كان Gemini 2.5 Flash-Lite بسعر 0.10$ / 0.40$، و3.1 Flash-Lite بسعر 0.25$ / 1.50$، و3.5 Flash-Lite بسعر 0.30$ / 2.50$ لكل مليون توكن، مع إدخال مخبّأ بسعر 0.03$. يكمن مكسب الكفاءة في السرعة واقتصاد التوكنات، وتُظهر قياسات Artificial Analysis الخاصة أن التكلفة الحقيقية لكل مهمة تضاعفت تقريبًا من جيل إلى جيل حتى مع انخفاض الوقت لكل مهمة إلى النصف.

لوحة النتائج المستقلة، المقروءة في السياق.

ضع النموذجين على نفس المؤشر وستكون الفجوة صارخة: Gemini 3.5 Flash-Lite عند 36، وLing 3.0 Tiny عند 23. لكن هذه المقارنة الرئيسية لا تمثل سوى نصف الصورة، لأن النموذجين لا يُقيَّمان على نفس المجال. AA تضع Ling 3.0 Tiny في المرتبة 6 من 56 ضمن فئة النماذج الصغيرة، مقابل متوسط الفئة 8 — أي أعلى بكثير من المتوسط لنموذج بحجمه. بينما يحتل Gemini 3.5 Flash-Lite المرتبة 12 من 151 عبر المجال الأوسع المتتبع. أحدهما نموذج صغير استثنائي؛ والآخر نموذج اقتصادي متين في التجمع المفتوح. كلتا العبارتين صحيحتان، وتعنيان أشياء مختلفة. Ling 3.0 Tiny يقدم قيمة أفضل مقارنة بفئة حجمه مما يقدمه Gemini 3.5 Flash-Lite مقارنة بفئته — ومع ذلك يظل Gemini 3.5 Flash-Lite هو النموذج الأكثر قدرة بفارق كبير على نفس المقياس المستقل.

Comparison scoreboard for Ling 3.0 Tiny vs Gemini 3.5 Flash-Lite. Left column Ling 3.0 Tiny: AA 23, $0.06 / $0.18 after promo, 210M output tokens, text-only, 256K context, speed N/A (Vercel 264 tok/s). Right column Gemini 3.5 Flash-Lite: AA 36, $0.30 / $2.50, 43M output tokens, text + image + video + audio, 1M context, ~490 tok/s (AA). Footer: 'Both models per Artificial Analysis.' OrcaRouter logo composited bottom-right.

الأبعاد، سطر واحد لكل منها:

• النتيجة المستقلة — Ling 3.0 Tiny AA Index 23 (#6/56، وسيط الفئة 8) مقابل Gemini 3.5 Flash-Lite AA Index 36 (#12/151).

• السعر — Ling 3.0 Tiny $0.06 / $0.18 لكل مليون بعد ترويج مجاني مقابل Gemini 3.5 Flash-Lite $0.30 / $2.50 لكل مليون (الإدخال المخزن مؤقتًا $0.03).

• الإسهاب — Ling 3.0 Tiny أنتج 210M رمزًا عبر تشغيل الفهرس مقارنةً بـ Gemini 3.5 Flash-Lite، وهو مُقاس لكنه غير مُطوَّل وفق هذا المؤشر.

• نمط الإدخال — Ling 3.0 Tiny نصّ فقط مقابل Gemini 3.5 Flash-Lite إدخال النصوص والصور والفيديو والصوت والملفات.

• السياق — 256K على Ling 3.0 Tiny مقابل 1M على Gemini 3.5 Flash-Lite، مع حد أقصى للإخراج يبلغ 64K على كلاهما.

• السرعة — Ling 3.0 Tiny ~90–264 tokens/s عبر نقاط النهاية التي نشرت رقمًا مقابل Gemini 3.5 Flash-Lite ~490 tokens/s في قياس AA المباشر.

صف السرعة هو الأكثر عرضة للتغير. سرعة إخراج Ling 3.0 Tiny غير محسومة فعليًا: إذ يدرجها Artificial Analysis كـ N/A، بينما تعلن Vercel عن 264 رمزًا في الثانية. أما ~490 رمزًا في الثانية لـ Gemini 3.5 Flash-Lite فهي قياس مباشر من AA تم التقاطه بعد فترة طويلة من استقرار تقلبات إطلاقه. بالنسبة لفئة حساسة لزمن الاستجابة، هذا هو الفرق بين قيمة معروفة وسؤال مفتوح.

اقتصاديات الإسهاب: لماذا المجاني ليس رخيصًا

إليك الحساب الذي يحسم عادةً هذه المقارنة. شغّل نفس المهمة الثقيلة من حيث المنطق — مثل 4,000 رمز إدخال و2,000 رمز إخراج — عبر كلا النموذجين بعد انتهاء العرض الترويجي لـ Ling 3.0 Tiny. يفوتر Ling 3.0 Tiny: (4,000 × $0.06 + 2,000 × $0.18) / 1,000,000، أي حوالي $0.0006. ويفوتر Gemini 3.5 Flash-Lite: (4,000 × $0.30 + 2,000 × $2.50) / 1,000,000، أي حوالي $0.0062. مع أعداد متطابقة من الرموز، يكون Ling 3.0 Tiny أرخص بعشر مرات. ثم أضِف الإسهاب: نموذج الاستدلال الذي يُخرج رموز تفكير كمخرجات لا يُنتج أعدادًا متطابقة من الرموز. إذا ظلّت نسبة الإسهاب 210M مقابل 63M الخاصة بـ Ling 3.0 Tiny قائمةً على عبء العمل لديك، فإن التكلفة الفعلية لكل مهمة تتضاعف تقريبًا ثلاث مرات في جانب الإخراج، وتتقلّص الميزة العشرية إلى 3–4 مرات. لا يزال أرخص — لكنه لم يعد مجانيًا، وليس في نفس مصافّ ما يوحي به رقم 210M.

الإطار الصادق هنا هو أن {{1}}النموذجين ليسا بديلين متكافئين في نفس المستوى من الجودة{{/1}}. حصول Ling 3.0 Tiny على 23 {{2}}نتيجة استثنائية لنموذج ينشّط 1.3B معلمة{{/2}}؛ بينما 36 في Gemini 3.5 Flash-Lite {{3}}مستوى مختلف تمامًا من القدرات، إضافة إلى الرؤية، وسياق 1M، وسرعة مثبتة{{/3}}. أنت تدفع ثمن تلك الفجوة — {{4}}خمسة أضعاف السعر لكل رمز، وأكثر لكل مهمة عند احتساب فروق السرعة{{/4}} — لكنها فجوة حقيقية في القدرات، لا فجوة تسويقية. إذا كان عبء عملك يتحمّل جودة النموذج الأرخص، فإن Ling 3.0 Tiny هو {{5}}الخيار الأفضل قيمة{{/5}}. أما إذا كان عبء عملك يحتاج إلى تلك القدرة، فلا ميزة سعرية تسدّ الفجوة.

حيث يُثبت جهاز التوجيه جدارته

هذا هو بالضبط شكل عبء العمل الذي تتفوق فيه طبقة التوجيه على الالتزام بنموذج واحد، وتفاصيل الاستضافة هي التي تحدد كيفية بنائه. Gemini 3.5 Flash-Lite متاح الآن على OrcaRouter بسعر القائمة لدى مزوّده — $0.30 للإدخال / $2.50 للإخراج لكل مليون، يُمرَّر بهامش ربح 0%، لذا فإن الرقم على بطاقة أسعار Go​ogle هو نفسه الرقم على جانبنا، وأي خفض مستقبلي في الأسعار يُطبَّق في اليوم نفسه. يعمل خلف نفس نقطة النهاية المتوافقة مع OpenAI التي تضم أكثر من 200 نموذج آخر، مع تجاوز تلقائي للفشل عبر المزوّدين في حال تدهور أداء المزوّد الأساسي أثناء التشغيل، ويمكن لـ DSL الخاصة بالتوجيه إرسال الاستعلام إلى عدة نماذج والاحتفاظ بأفضل إجابة.

Ling 3.0 Tiny ليس على OrcaRouter؛ بل يتم تقديمه عبر نقاط نهاية خاصة به، وهو مجاني اليوم. هذا المزيج في الواقع يجعل حالة التوجيه أقوى وليس أضعف. استغل الفترة المجانية لقياس أداء Ling 3.0 Tiny على حركة المرور الخاصة بك قبل أن تصبح مدفوعة الأجر. ثم ابنِ مسار الإنتاج على الطبقة المستضيفة — Gemini 3.5 Flash-Lite للمكالمات التي تتطلب الرؤية، أو السياق الطويل، أو ملف سرعة مستقر، مع بقاء طبقة التوجيه حرة في التصعيد إلى نموذج أغلى للأقلية الصعبة. الطبقة المجانية تجربة رائعة واعتماد هشّ؛ أما الطبقة المستضيفة فهي ما يمكنك بناء منتجك عليها. على OrcaRouter يمكنك تشغيل كلاهما في نفس الرسم البياني — Ling 3.0 Tiny عبر نقطة نهاية مباشرة، وGemini 3.5 Flash-Lite عبر مفتاح — والسماح للموجّه بالاختيار لكل طلب.

Screenshot of the OrcaRouter model page for Gemini 3.5 Flash-Lite (google/gemini-3.5-flash-lite) showing $0.30 input / $2.50 output per 1M tokens, a 1M-token context, up to 64K max output, multimodal text + image + video + file + audio input, and a p50 time-to-first-token of 819ms over the last 7 days. Fresh Edge-headless capture, audited.

حكم

إذا كنت تختار بين هذين الاثنين ولا تنوي استخدامهما معًا، فالقرار سهل الصياغة وصعب التقبّل. Ling 3.0 Tiny هو الصفقة الأفضل والنموذج الأضعف: طبقة استدلال نصية فقط عمرها أسبوع، بدرجة ممتازة لحجمها، وسعر منافس، وصورة غير محسومة بعد للسرعة والإسهاب، وهو يستحق تقييمًا فوريًا عبر النسخة التجريبية المجانية، ويجدر بك أن تعلم أن استخدامه سيُحتسب بالعداد في 14 أغسطس. أما Gemini 3.5 Flash-Lite فهو الخيار الافتراضي الأكثر أمانًا للإنتاج: فقد حصل على درجة أعلى بـ13 نقطة في التقييم المستقل، وهو متعدد الوسائط، بسياق مليون رمز، وأسرع خمس مرات وفق قياس مستقر، ومُسعَّر وفق ذلك. المجاني ليس رخيصًا عندما يتحدث النموذج ثلاثة أضعاف الكلام ليفكّر عند سقف قدرات أدنى — والنموذج الحالي هو الرهان الآمن لسبب وجيه.

© 2026 OrcaRouter

لمقدمي الخدمات

هل تدير منصة استدلال؟ اعرض نماذجك على OrcaRouter.

تواصل معنا

انضم إلى مجتمعنا

DiscordEmailXGitHubYouTube