بطاقة رئيسية مُولَّدة بعنوان 'Astra for Law vs GPT-6 Astra'، بعنوان فرعي 'نفس الأوزان — أحدهما يضيف فهرس بحث قانوني'، مع سطر تاريخ نصه 'أُعلن عن Astra for Law في 17 سبتمبر 2026 · صدر GPT-6 Astra في 3 سبتمبر 2026'، فوق بطاقتين: اليسرى 'Astra for Law — فهرس قانوني + تعليمات، السعر غير معلن' واليمنى 'GPT-6 Astra — بحث ويب، 10 دولارات إدخال / 50 دولارًا إخراج لكل 1M'، مع تذييل 'أرقام البائع لم يُعَد إنتاجها؛ درجة لوحة GPT-6 Astra العامة وفقًا لـ Vals AI.' وشعار OrcaRouter مُركَّب في الزاوية السفلية اليمنى.
Guides & Insights

Astra للقانون مقابل GPT-6 Astra: نفس الأوزان، فهرس بحث إضافي واحد

الكاتب

Elias Hawthorne

تاريخ النشر

أحدث النماذج · 20عرض جميع النماذج
المعايير: Artificial Analysis · يُحدَّث يوميًا
العودة إلى جميع المقالات

Astra for Law وGPT-6 Astra ليسا نموذجين، وتصوير الاختيار بينهما كمواجهة مباشرة هو أول ما ينبغي إدراكه إدراكًا صحيحًا. Astra for Law هو GPT-6 Astra مع فهرس بحث قانوني أمريكي مثبّت في مسار الاسترجاع الخاص به، ومجموعة من تعليمات الصياغة القانونية مضافة فوق ذلك، وأدوات قانونية ملحقة به. الأوزان متطابقة. لذا فالسؤال الحقيقي ليس أي النموذجين أذكى — بل ما إذا كان فهرس البحث القانوني يستحق دفع مبلغ إضافي مقابله، وبناءً على الأدلة المتاحة حتى الآن، تعتمد الإجابة تقريبًا كليًا على ما إذا كان عملك هو استرجاع السوابق القضائية أم مراجعة المستندات.

هذا مهم لأن OpenAI لم تنشر سعرًا للإعداد القانوني، وواجهة برمجة التطبيقات الخاصة به ليست مفتوحة، والقياس الوحيد وجهاً لوجه مقابل النموذج الأساسي يأتي من OpenAI نفسها على مجموعة تحقق خاصة. تستعرض هذه الصفحة ما المعروف فعليًا، وما تقوله الأرقام المستقلة، وإلى أي جانب من المقارنة ينتمي عبء عمل قانوني معيّن.

ما الذي يفصل بينهم بالضبط؟

تمت إضافة ثلاثة أشياء، وليست متساوية في صعوبة تكرارها.

فهرس البحث القانوني — استرجاع يغطي السوابق القضائية الأمريكية، والتشريعات، واللوائح، وقواعد المحاكم، والقرارات الإدارية، وأكثر من 230 مليون رابط، ومصادر تُضاف يوميًا. هذا هو الجزء الذي لا يمكنك بناؤه من موجّه.

Corpus — مبنيّ على CourtListener، مكتبة Free Law Project التي تغطي أكثر من 99.9% من السوابق القضائية الأمريكية المنشورة، مدعومًا بمحتوى مرخّص من مزوّدين من بينهم Thomson Reuters. النصف العام مجاني؛ أما النصف المرخّص والتحديث اليومي فليسا شيئًا تستطيع شركة محاماة منفردة إعادة إنتاجه.

التعليمات والإعدادات — تعليمات التحليل القانوني والكتابة القانونية، إضافة إلى إعدادات مثل طول الاستجابة. وهذه على مستوى التوجيه ومستوى التكوين. ويمكن لفريق كفء في الهندسة القانونية أن يقارب جزءًا معتبرًا منها باستخدام النموذج الأساسي اليوم.

A generated two-column scoreboard titled 'Astra for Law vs GPT-6 Astra — the scoreboard'. Left column 'Astra for Law' rows: 'Retrieval: Legal Search Index, 230M+ URLs', 'Instructions: legal-specific', 'Headline score: 54.0% vendor-reported', 'Availability: Trusted Access, Am Law 200', 'API model id: gpt-6-astra-law, coming soon', 'Price: not disclosed'. Right column 'GPT-6 Astra' rows: 'Retrieval: general web search', 'Instructions: general', 'Public board score: 39.42% on Vals AI', 'Availability: generally available now', 'API model id: gpt-6-astra', 'Price: $10.00 in / $50.00 out per 1M'. Footer reads 'Astra for Law figures OpenAI-reported on a private split; GPT-6 Astra public board figure per Vals AI.', with the OrcaRouter logo composited in the bottom-right corner.

في GPT-6 Astra وحده، يجري الاسترجاع عبر البحث العام على الويب. وهذا هو الفرق بأكمله في مسار البحث، وهو المحور الذي يقيسه كل رقم أدناه.

المواجهة المباشرة الوحيدة الموجودة

اختبرت OpenAI كلا الجانبين على 200 سؤال بحث قانوني أمريكي من مجموعة التحقق الخاصة في Vals AI's Legal Research Bench. عند أعلى جهد استدلالي، اجتاز Astra for Law فحص الصحة الإجمالي في 54.0% من الأسئلة مقابل 38.7% لـ GPT-6 Astra مع البحث عبر الويب — 15.3 نقطة، ووصفت بأنها تحسن نسبي بنسبة 40%. أرقام داعمة من نفس التشغيل: العثور على حالات مرجعية أكثر بنسبة 24% في أسئلة السوابق القضائية، واسترجاع مقاطع ذات صلة أكثر بنسبة تصل إلى 54% من آراء المحاكم الصحيحة عند جهد استدلالي متساوٍ، وإجابات يبلغ متوسط طولها ضعف الطول تقريبًا.

ثلاثة تحذيرات تلزم تلك الأرقام، ولا يعد أي منها سببًا لتجاهلها. أولًا، إنها أرقام OpenAI، على تقسيم بيانات تملكه OpenAI، ولم يكرّرها أي طرف مستقل. ثانيًا، يجدر أخذ مضاعفة طول الإجابة في الاعتبار إلى جانب الدرجة المركبة، لأن فحص الصحة الذي يكافئ التغطية يكون اجتيازه أسهل بإجابة أطول — فأرقام الاسترجاع (24% حالات أكثر، 54% مقاطع أكثر) هي الدليل الأوضح على ما يضيفه المؤشر فعليًا. ثالثًا، لا تُظهر النسخة العامة من المعيار نفسه القفزة: تُدرج صفحة المقارنة الخاصة بـ Vals AI النموذج GPT-6 Astra عند 39.42% ±3.40 على Legal Research Bench، مع Gemini 3.8 Flash عند 38.94% ±3.39. هذا هو النموذج الأساسي، من دون المؤشر، وهو يحلّ أساسًا حيث يقع خط أساس OpenAI.

A screenshot of the Vals AI 'Compare Models' leaderboard captured September 18, 2026, comparing Gemini 3.8 Flash and GPT-6 Astra: Legal Research Bench (Agentic US legal research) shows Gemini 3.8 Flash 38.94% ±3.39 against GPT-6 Astra 39.42% ±3.40; Vals Index shows 62.25% against 66.61%; and the table also lists Finance Agent (V2) 61.44% vs 53.54%, Tax Agent Bench 66.77% vs 63.34%, MedCode 48.13% vs 48.49%, Terminal-Bench Science 8.57% vs 65.71%, Code Migration 36.55% vs 67.74%, Terminal-Bench 4.0 13.13% vs 57.07% and Vibe Code Bench v1.1 78.65% vs 89.59%, with a Vals Index date of 2026-09-11.

قراءتان مستقلتان تزيدان الصورة تعقيدًا. أجرت Legora مطابقة للقوائم المالية عبر 41 مستندًا في تمريرة واحدة، فوجدت الأخطاء الأربعة المزروعة كافة، بما في ذلك فجوة قدرها 500,000 جنيه إسترليني في ملاحظة الإيرادات، مضيفةً نحو خمسين فحصًا كان النموذج الأسبق قد فاته — أي تحسّن بنحو 40% في سير العمل ذلك. غير أنّ المتوسط الإجمالي للتحسّن في Benchmark for Agentic Reasoning الخاص بـ Legora عبر جميع المهام كان نحو 3%. وفي الوقت نفسه، وضع اختبار HAQQ المكوّن من 41 سؤالًا عبر 20 مجال ممارسة تفوّق Astra في الجوهر القانوني عند 17.63 من 20، بفارق أقل من نقطة عن نماذج أرخص، وبكلفة 0.2622 دولار لكل إجابة. وإذا قُرئت معًا، فالخلاصة الصادقة هي أنّ تفوّق هذا التكوين كبير وقابل للتكرار في الأعمال المعتمدة بكثافة على الاسترجاع من السوابق القضائية الأمريكية، وهزيل في الاستدلال القانوني العام، وغير مُختبر إلى حد كبير في القوانين خارج الولايات المتحدة — حيث وجد الاختبار نفسه أن النماذج الثلاثة كلها تستشهد بالبند الصحيح بينما تخطئ في بيان ما ينصّ عليه.

لا يوجد سعر منشور لـ Astra for Law. بطاقة أسعار GPT-6 Astra علنية، وهي الرقم الذي يجب أن تُبنى عليه المقارنة، لأن التهيئة القانونية هي النموذج نفسه مضافًا إليه الاسترجاع، ولا يُعقل أن تكلّف أقل من النموذج الذي تغلّفه.

قياسي — 10.00 دولار لكل مليون رمز إدخال، 50.00 دولار لكل مليون رمز إخراج.

الإدخال المخزّن مؤقتًا — $1.00 لكل مليون، وخصم بنسبة 90%، وهي الرافعة الأكثر أهمية لشركة تعيد استخدام التعليمات الدائمة والصيغ النموذجية للسوابق.

كتابات ذاكرة التخزين المؤقت — $12.50 لكل مليون، تُفوتَر بسعر 1.25× من سعر الإدخال غير المُخزَّن مؤقتًا؛ ويصبح التخزين المؤقت مُجديًا بدءًا من إعادة الاستخدام الثانية فصاعدًا.

أكثر من 272,000 من رموز الإدخال — 2× لمعدلات الإدخال والتخزين المؤقت و1.5× للإخراج، وتُطبَّق على الطلب بالكامل، وليس فقط على الرموز التي تتجاوز الحد. عملياً، يعني ذلك 20.00 دولاراً للإدخال و75.00 دولاراً للإخراج لكل مليون لأي طلب طويل.

الدفعة — 50% من الوضع القياسي. الوضع السريع — 2× الوضع القياسي، وغير متاح لـ GPT-6 Astra مع إقامة البيانات في الاتحاد الأوروبي.

عتبة 272 ألف ليست حاشية في هذه المقارنة؛ بل هي قلبها. فمطابقة مستندية من 41 مستندًا، أو مجموعة كاملة من نصوص الإفادات، أو ملف صفقة يمتد لسنوات، تتجاوز 272,000 توكن بشكل روتيني، ما يعني أن السعر القانوني الواقعي هو صف السياق الطويل — $20.00 للمدخلات و$75.00 للمخرجات — لا السعر الرئيسي $10/$50. وبالنسبة لمكتب محاماة يقدّر نطاق مشروع تجريبي، فإن الفرق بين هذين الصفين هو الفرق بين مشروع يتسع له الميزانية ومشروع لا يتسع لها، وهو سبب لقياس حجم التوكن الفعلي لكل قضية لديك قبل الالتزام لا بعده.

ملاحظتان إضافيتان حول التكلفة من اختبار مستقل. سجّلت HAQQ $0.2622 لكل إجابة على Astra، أي نحو أحد عشر ضعفًا لتكلفة كل إجابة لدى GPT-5.6 Luna Pro مقابل أقل من نقطة من المكسب المركّب — لكنها لاحظت أيضًا أن الفجوة سببها جزئيًا أن Astra تكتب نحو 3.5× توكنات أقل من Claude Opus 5، ما يجعلها أرخص لكل إجابة من Opus 5 في عبء العمل هذا. ووجد الاختبار نفسه أن مقبض جهد الاستدلال يتصرف كرافعة تكلفة لا كرافعة جودة: الانتقال من منخفض إلى مرتفع ضاعف التكلفة بنحو 1.5× وزمن الاستجابة بنحو 1.8×، بينما انخفضت الجودة المُقيَّمة 0.17 نقطة. ثبّت إعداد الجهد؛ لا تتركه على الحد الأقصى افتراضيًا.

عندما تكون الفئة الأساسية هي الصفقة الأفضل

إن الحجة لصالح GPT-6 Astra وحده أقوى مما يوحي به تأطير الإطلاق، وهي تقوم على ثلاث ملاحظات.

• عملك ليس استرجاعًا للسوابق القضائية الأمريكية. الفهرس مقتصر على الولايات المتحدة. بالنسبة لصياغة العقود، أو إعادة هيكلة البنود، أو الاستقبال الأولي للقضايا، أو بناء التسلسل الزمني، أو تلخيص المستندات التي بحوزتك بالفعل، فإن ما يضيفه Astra for Law يظل غير فعّال إلى حد كبير.

• أنت تدفع بالفعل مقابل البحث القانوني الأولي. أي شركة محاماة لديها اشتراكات في Westlaw أو LexisNexis تشتري التغطية نفسها للسوابق القضائية مرتين إذا دفعت أيضًا مبلغًا إضافيًا مقابل طبقة استرجاع لا تستطيع تدقيقها.

• أنت تريد مسار الاستدعاء الذي تتحكم فيه. إن تغذية مجموعة مستندات منسّقة في نموذج GPT-6 Astra الأساسي تمنحك مصدرية الاستشهادات التي يمكنك فحصها، ودون أي اعتماد على تحديث فهرس أحد المورّدين.

هناك دليل من طرف ثالث على أن النموذج الأساسي ليس الحلقة الأضعف. في لوحة صدارة APEX-Agents لمحامي الشركات من Mercor، سجّل أحد إعدادات GPT-6 Astra نسبة 73.4% في Pass@1 عبر 160 مهمة — نتيجة من طرف ثالث على عبء عمل وكيل قانوني، وتأتي إلى جانب متوسط زيادة قدره 3% قاسته Legora عبر مجموعة المعايير الخاصة بها. لا يتعلق أي من الرقمين بفهرس البحث، وكلاهما يشير إلى أن النموذج الكامن يقوم بالفعل بمعظم العمل القانوني.

عندما يستحق التكوين علاوته السعرية

الحجة الداعية إلى Astra for Law أضيق نطاقًا، وحيثما تنطبق، فهي حاسمة. إذا كان عبء عملك يتمثل في العثور على السلطة القانونية الأمريكية وتطبيقها — بناء قائمة القضايا في مذكرة قانونية، والتحقق مما إذا كان موقف ما يصمد أمام سلسلة من القرارات، وإجراء مسح تنظيمي على مستوى الخمسين ولاية — فإن الحصول على قضايا مرجعية أكثر بنسبة 24% ومقاطع ذات صلة أكثر بنسبة تصل إلى 54% ليس تحسينًا هامشيًا، بل هو الفرق بين مساعد يغفل عن سلطة قانونية وآخر لا يغفل عنها. وتُعدّ عملية المطابقة في Legora أفضل توضيح متاح للأثر نفسه على المستندات بدلًا من السوابق القضائية: فالإحالة المتقاطعة على 41 ملفًا في تمريرة واحدة هي بالضبط عمل المقارنة الطويل السياق وعالي الحجم، حيث يتراكم أثر مزيد من السياق المسترد.

التحفظ الصادق على كليهما: التسعير غير معلن، والوصول محصور بشركات Am Law 200 من خلال برنامج Trusted Access، ولم يُعِد أي مختبر مستقل إجراء المقارنة المباشرة. يُطلب منك الالتزام بدفع علاوة استنادًا إلى معيار أداء من البائع واختبار سير عمل شريك واحد.

تشغيل كليهما عبر نقطة نهاية واحدة

مسألة التوجيه هنا هي مشكلة تسلسل لا اختيار. فـ gpt-6-astra-law ليس موجودًا في أي API بعد، بما في ذلك ours — قالت OpenAI إنه قادم قريبًا ولم تذكر موعدًا — لذا اليوم فإن النصف الوحيد من هذه المقارنة الذي يمكنك استدعاؤه فعليًا هو النموذج الأساسي. المتاح الآن هو openai/gpt-6-astra على OrcaRouter عند هامش ربح 0%، مع تمرير سعر قائمة المزوّد كما هو دون تغيير، لذا فإن صفّي $10/$50 و$20/$75 أعلاه هما ما تدفعه، وأي تغيير في سعر البائع يظهر في اليوم نفسه. أكثر من 200 نموذج خلف مفتاح واحد، مع تجاوز تلقائي عند الفشل عبر المزوّدين.

A screenshot of the OrcaRouter catalogue page for GPT-6 Astra, captured September 18, 2026, showing the listing openai/gpt-6-astra from provider OpenAI with a 1M token context, 128K max output, input of text + image + file with text output, p50 time to first token of 6.01 s and p95 of 10.00 s, $10.00 input and $50.00 output per 1M tokens, 162.0M tokens of routed traffic over seven days, and an OpenAI-compatible Python sample using base_url https://api.orcarouter.ai/v1.

إن routing DSL هو الجزء الذي يتوافق مع هذا القرار المحدد. ولأن الفارق بين المنتجين هو خطوة استرجاع، يمكنك تركيبه بنفسك — وجّه النموذج الأساسي باستخدام استرجاع المستندات الخاص بك في نداء واحد، وقارن الناتج مع نفس السؤال المُرسَل بالبحث على الويب فقط. هذه طريقة رخيصة لقياس مقدار فجوة 54.0% مقابل 38.7% التي يعيدها corpus الخاص بك، قبل أن تلتزم بمنتج متميز مقيّد. دمج النماذج، الذي يشغّل لوحة من النماذج على موجّه واحد، يغطي النصف الآخر: إذا كان قلقك أن نموذجًا واحدًا يسيء قراءة بند، كما وجدت HAQQ في القانون غير الأمريكي، فإن اللوحة تُظهر الخلاف بدلًا من إخفائه. ولأن التوجيه يبقي كلا الجانبين على مفتاح واحد، فإن تبديل معرّف النموذج عند فتح gpt-6-astra-law هو تغيير في التكوين، وليس إعادة تكامل.

من المحاذير التي يجدر ذكرها بدل طمسها: الطلب الموجَّه لا يشمله تلقائيًا اعتماد OpenAI للاحتفاظ الصفري بالبيانات (ZDR)، الذي يُمنح لكل مؤسسة على حدة، لذا ينبغي للشركة التي تحتاج إلى ZDR أن تتأكد من التغطية على المسار الذي تستخدمه. كما أن الراوتر ليس سوى قفزة إضافية في مسار البيانات — تكلفة حقيقية بالنسبة إلى المواد الخاضعة للامتياز، حتى عندما يوفّر تجاوز الأعطال.

إلى أين ينتهي هذا

إذا كنت تختار اليوم، فاختر النموذج الأساسي. لا يمكن شراء Astra for Law بعد، وسعر نسختها المميزة غير معروف، وتقول الأدلة المستقلة إن GPT-6 Astra يؤدي بالفعل على مستوى عالٍ في أعباء عمل الوكلاء القانونيين دون الفهرس. ابنِ على openai/gpt-6-astra الآن، وقِس فجوة الاسترجاع الخاصة بك، ودع محاسبة التوكنات تخبرك ما إذا كنت تتجاوز 272K غالبًا بما يكفي لتهتم بصف السياق الطويل.

ثم أعد النظر فيه عندما تُعرف ثلاثة أمور: سعر gpt-6-astra-law، وشكل شروط API الخاصة به، وإعادة تشغيل مستقلة للمواجهة المباشرة المكوّنة من 200 سؤال على تقسيم يتحكم فيه طرف غير OpenAI. إذا استقر السعر قريبًا من المعدل الأساسي وصمدت مكاسب الاسترجاع خارج مجموعة التحقق الخاصة بـ OpenAI، يصبح هذا التكوين هو الخيار الافتراضي الواضح للأعمال الأمريكية الكثيفة البحث، ويظل النموذج الأساسي هو المناسب لكل ما عدا ذلك. وحتى ذلك الحين، فإن الادعاء القابل للدفاع هو الادعاء الضيق — وهو أن فهرس السوابق القضائية الأمريكية مضافًا إليه تعليمات قانونية يسترجع بجودة أفضل بشكل جوهري من البحث العام على الويب في الأسئلة القانونية الأمريكية. وهذا يستحق أن يُدفع مقابله شيء. أما كم، فلا يزال سؤالًا مفتوحًا.

مقارنات في هذه المقالة1

مستخرج من هذه المقالة · المعايير: Artificial Analysis · يُحدَّث يوميًا