Skip to content
    HAQQ
    • الأسعار
    ابدأ مجاناً
    ابدأ مجاناًاحجز عرضاً تجريبياً
    تسجيل الدخول
    مركز الموارد

    تصفح

    • مهارات الذكاء الاصطناعي القانوني338
    • المدونة166
      • معيار الذكاء الاصطناعي القانوني 2026: كيف كان أداء HAQQ في تقييمٍ مستقل
      • الذكاء الاصطناعي القانوني للمؤسسات: ما الذي تتحقق منه المنظمات الكبرى قبل أن تثق به
      • أفضل ذكاء اصطناعي قانوني لمحامي الهجرة
      • الذكاء الاصطناعي للبحث القانوني المدعوم بالمصادر: النصوص القانونية والسوابق عبر الاختصاصات القضائية
      • مكتب المحاماة 3.0: لماذا تحتاج المكاتب إلى نظام تشغيل قانوني
      • هل يمكن للذكاء الاصطناعي أن يحل محل المحامين؟ لا - وإليك لماذا هذا سؤال خاطئ
      • هل الاستشارة القانونية بالذكاء الاصطناعي آمنة ودقيقة؟ ما يجب التحقق منه قبل الوثوق بذكاء اصطناعي قانوني
      • اختلاق الذكاء الاصطناعي القانوني: الاستشهاد المزيّف الذي يجتاز كل تدقيق
      • الذكاء الاصطناعي لمحامي الطلاق: دليل من 8 مراحل (2026)
      • بدائل Spellbook: أفضل أدوات صياغة العقود بالذكاء الاصطناعي في 2026
      • شركات الذكاء الاصطناعي القانوني الناشئة في سان فرانسيسكو: خريطة 2026 (Harvey، Eve، GC AI، Ivo)
      • HAQQ مقابل Onit: الذكاء الاصطناعي القانوني مقابل إدارة الشؤون القانونية للمؤسسات (2026)
      • مراجعة CoCounsel لعام 2026: الأسعار والمعيار والبدائل
      • Harvey ضد Legora ضد CoCounsel: معيار واحد من 50 نقطة
      • مراجعة Lexis+ AI: مقابل Westlaw CoCounsel، بالدرجات
      • عرض الكل61
    • أدوات مجانية20
    • كيفية استخدام HAQQ27
    • شهادة محامي الذكاء الاصطناعي29
    • الحلول174
    • الأوراق البيضاء2
    • بحث29
    1. الرئيسية
    2. المدونة
    3. معيار الذكاء الاصطناعي القانوني 2026: كيف كان أداء HAQQ في تقييمٍ مستقل
    العودة للمدونةالذكاء الاصطناعي والتقنية القانونية

    معيار الذكاء الاصطناعي القانوني 2026: كيف كان أداء HAQQ في تقييمٍ مستقل

    أخضعت جهةُ تقييمٍ مستقلّة أداة HAQQ لاختبارٍ شمل 61 مهمّة قانونية صعبة في 21 دولة، ونُفّذت كل مهمّة مرّتين. نجح HAQQ في 27.0% من المهام إجمالًا، وفي 5.9% من أصعب المهام - مقابل 1.1% فقط لمتوسّط أدوات الذكاء الاصطناعي القانوني الأخرى. التفاصيل والأرقام الكاملة في المقال.

    ٢٣ يوليو ٢٠٢٦
    11 دقائق للقراءة
    |
    HAQQ Research
    معيار الذكاء الاصطناعي القانوني 2026: كيف كان أداء HAQQ في تقييمٍ مستقل

    الخلاصة (TL;DR) — سلّمنا HAQQ إلى جهة تقييمٍ مستقلّة، وطلبنا منها أن تختبره بعين المشتري المتشكّك تمامًا: 61 مهمّة قانونية حقيقية في 21 ولاية قضائية، مع تنفيذ كل مهمّة مرّتين، دون أي توجيهٍ مُسبق أو صلاحياتٍ خاصّة.

    نجح HAQQ في 27.0% من المهام إجمالًا، متجاوزًا متوسّط أدوات الذكاء الاصطناعي القانوني ومتوسّط القطاع معًا. وفي الفئة الأصعب (The High Bar) — وهي المهام التي يعجز عن إنجازها تقريبًا كل ما في السوق — نجح HAQQ بنسبة 5.9% مقابل 1.1% لمتوسّط أدوات الذكاء الاصطناعي القانوني، أي أكثر من خمسة أضعاف بقية السوق.

    كما كان الأقوى بين جميع الأدوات المُختبَرة في الصياغة وفق القانون العُماني، وسجّل 65.2% في التعامل مع المستندات الممسوحة ضوئيًا ومتدنّية الجودة، وبلغ 100% في المهام المصمَّمة خصيصًا لإغرائه باختلاق محتوى غير موجود.

    ننشر أرقامنا نحن أدناه. أما المنتجات المنافِسة فتظهر ضمن متوسّطٍ إجمالي فقط — وهذا شرطُ الإفصاح الذي وضعته جهةُ التقييم، لا اختيارُنا.

    لماذا اخترنا تقييمًا مستقلًا

    معظم اختبارات الذكاء الاصطناعي القانوني تُجريها الشركات التي تبيع المنتج نفسه، واختبارنا الداخلي من بينها، وهو منحاز بطبيعته لأنه اختبارنا نحن. لذلك فعلنا العكس: سلّمنا HAQQ إلى جهة تقييمٍ مستقلّة لا مصلحة لها في النتيجة، وطلبنا منها تقييمه في مواجهة بقية السوق.

    حين يُجري الاختبارَ طرفٌ لا يكسب شيئًا من نتيجته، يصبح للرقم معنى مختلف. وهذا هو الاتجاه الذي يسير إليه السوق: المشترون — وحتى نماذج الذكاء الاصطناعي التي تُوصي بالأدوات — باتوا يبحثون عن مصادر مستقلّة موثوقة بدل الدعاية التسويقية. ونحن نفضّل أن نستحقّ الدرجة على أن نَدّعيها.

    كيف يعمل هذا التقييم

    الدرجة لا تساوي أكثر من المنهجية التي تقف خلفها، وإليك المنهجية كاملة. لم نصمّم أيًّا من هذا — إنها منهجية جهة التقييم المنشورة، مُطبَّقة بالطريقة نفسها على كل أداة في المجموعة.

    • 61 مهمّة حقيقية أعدّها محامون ممارسون، تشمل صياغة العقود واستخراج المعلومات، في 21 ولاية قضائية من بينها الولايات المتحدة وبريطانيا والهند وسنغافورة وهولندا وعُمان.
    • تصل المستندات كما هي في الواقع العملي — ملفات Word أصلية، وملفات PDF، ومستندات ممسوحة ضوئيًا، وصور فوتوغرافية، وملفات تحمل تعديلات متتبَّعة. لا شيء يُحوَّل مسبقًا إلى نصٍّ نظيف، فقراءة الملف الأصلي جزءٌ من الاختبار نفسه.
    • معايير نجاح/رسوب قاطعة، كتبها محامون وثُبّتت قبل الاختبار. لا تنجح المهمّة إلا إذا استوفت كل معيار مُنطبِق. وحين يكون هناك أكثر من إجابة مقبولة مهنيًا تسمح المعايير بذلك، لكنها ترسّب الأخطاء والإغفالات المحدَّدة.
    • محوران لا يُخلَطان أبدًا: المضمون والشكل. المضمون يسأل: هل العمل صحيح وكامل؟ والشكل يسأل: هل يستطيع المحامي استخدامه كما سُلِّم؟ الإجابة المصقولة شكلًا لكنها خاطئة قانونيًا تُعدّ راسبة.
    • تُنفَّذ كل مهمّة مرّتين بشكل مستقل، والدرجة هي متوسّط المحاولتين — حتى لا تحمل النتيجةَ محاولةٌ واحدة محظوظة.
    • يُقيّم كل مُخرَج حَكَمان مستقلّان من نماذج الذكاء الاصطناعي، وأي خلاف قد يغيّر نتيجة النجاح يُحال إلى محامٍ مؤهّل يراجع المُخرَج دون معرفة الأداة التي أنتجته. والحكم البشري نهائي ويُحفظ للتدقيق.
    • الفئة الأصعب (The High Bar) هي المهام التي لم تستطع إنجازها سوى أداتين على الأكثر من أصل 10 أدوات مُقيَّمة: 34 مهمّة، جرى تقييمها عبر 68 محاولة. وُجدت خصيصًا لتفصل الأداء الاستثنائي عن الكفاءة العادية.

    نتيجتان يجدر استيعابهما قبل قراءة أي رقم أدناه. الأولى: نسب النجاح في هذا التقييم تبدو منخفضة بشدّة مقارنةً بالأرقام التسويقية في أماكن أخرى — وذلك بسبب قاعدة «كل المعايير أو لا شيء»، وهي تنطبق على الجميع بالتساوي. الثانية: لا نرى أبدًا درجات منافسينا فُرادى؛ فجهة التقييم لا تُظهر لنا سوى متوسّط عام لأدوات الذكاء الاصطناعي القانوني، ولهذا يقارن هذا المقال HAQQ بالمتوسّطات لا بمنتجات مُسمّاة.

    أبرز الحقائق

    • نسبة النجاح الإجمالية: 27.0%، أعلى من متوسّط أدوات الذكاء الاصطناعي القانوني ومتوسّط القطاع. لا تنجح المهمّة إلا باستيفاء كل معيار وضعه المحامون، ولهذا فالأرقام المطلقة منخفضة عبر المجال كله.
    • الفئة الأصعب: 5.9% مقابل 1.1%. في أصعب مجموعة، نجح HAQQ بأكثر من خمسة أضعاف متوسّط أدوات الذكاء الاصطناعي القانوني، وقرابة ثلاثة أضعاف متوسّط الأدوات العامّة.
    • الأقوى بين جميع الأدوات المُختبَرة في الصياغة وفق القانون العُماني (50.0%) — ليس منافِسًا فحسب، بل الأقوى.
    • 100% في التعامل مع المراجع المفقودة. في مهام صُمِّمت لدفع النموذج إلى اختلاق ملاحق ومراجع غير موجودة، حافظ HAQQ على الفجوة في كل مرة.
    • 2.53 من 3 في الشكل — الوضوح 2.73، والبنية 2.65 — أعلى من المتوسّطين. صحيحٌ وقابل للاستخدام كما سُلِّم.
    • كانت مجموعة المهام صعبة عمدًا؛ والمجال كله يسجّل درجات منخفضة، لأن معظم الأدوات ما زالت تفشل في العمل القانوني الصعب فعلًا.

    ماذا أظهر التقييم

    إليك الأرقام في مقارنة مباشرة. «متوسّط الذكاء الاصطناعي القانوني» هو مجموع بقية أدوات الذكاء الاصطناعي القانوني المُقيَّمة؛ و«متوسّط الأدوات العامّة» هو مساعدات المحادثة المتقدّمة. الشكل يُقيَّم من 1 إلى 3، حيث 3 هي الأفضل.

    المقياسHAQQمتوسّط الـ AI القانونيمتوسّط الأدوات العامّة
    صياغة العقود — نسبة النجاح24.2%20.6%23.9%
    صياغة العقود — الشكل (1–3)2.562.442.44
    استخراج البيانات — نسبة النجاح30.0%29.6%29.3%
    الفئة الأصعب — نسبة النجاح5.9%1.1%2.2%

    وهذه المقاييس التي أوردتها جهة التقييم لـ HAQQ وحده:

    المقياسHAQQ
    نسبة النجاح الإجمالية27.0%
    الشكل الإجمالي (1–3)2.53
    صياغة العقود — المعايير المستوفاة78.6%
    القراءة الضوئية والمسح — المعايير المستوفاة65.2%
    الصياغة وفق القانون العُماني50.0%
    التعامل مع المراجع المفقودة100.0%
    النجاح المتكرّر عبر المحاولتين21.3%

    صياغة العقود

    قيّمت جهةُ التقييم الصياغة على محورين: المضمون (هل الإجابة دقيقة وكاملة؟) والشكل (هل المُخرَج مصقول وجاهز لعرضه على العميل؟).

    تفوّق HAQQ على الأدوات العامّة وعلى متوسّط أدوات الذكاء الاصطناعي القانوني في كليهما: 24.2% نسبة نجاح مقابل 23.9% و20.6%، و2.56 من 3 في الشكل مقابل 2.44 للمجالين. وعلى مستوى المعايير الفردية لا المهام الكاملة، استوفى HAQQ 78.6% مما طلبه المحامون. ليس صحيحًا تقنيًا فحسب، بل صحيحٌ وجاهز للعميل.

    الفئة الأصعب: أصعب المهام

    داخل التقييم مجموعةٌ أصغر من أصعب المسائل، تُسمّى رسميًا الفئة الأصعب (The High Bar): 34 مهمّة لم تستطع إنجازها سوى أداتين على الأكثر من أصل 10 أدوات مُقيَّمة. عملٌ متعدّد الخطوات، ومستندات مرجعية متعدّدة، ووقائع معقّدة. النوع الذي ينهار أمامه معظم الذكاء الاصطناعي ببساطة.

    نجح HAQQ في 5.9% من تلك المحاولات الـ68. متوسّط أدوات الذكاء الاصطناعي القانوني نجح في 1.1%، ومتوسّط الأدوات العامّة 2.2%. أي أكثر من خمسة أضعاف مجال الذكاء الاصطناعي القانوني، وقرابة ثلاثة أضعاف مساعدات المحادثة المتقدّمة — وهو أوسع فارق سجّله HAQQ في التقييم كله.

    اقرأ هذه الأرقام بصدق: 5.9% رقمٌ منخفض بالمطلق، وهذا ما ينبغي أن يكون. فهذه مهام اختِيرت تحديدًا لأن الصناعة كلها تفشل فيها. الفارق هو الإشارة هنا، لا المستوى. وهذا هو الجزء الأهم بالنسبة إلينا، لأنه يشبه العمل القانوني الحقيقي لا مجرّد عرض توضيحي.

    ثلاثة أمور لافتة

    1. العمل القانوني في الشرق الأوسط

    في الصياغة الخاضعة للقانون العُماني، حقّق HAQQ أقوى النتائج في التقييم، بنسبة 50.0%. ليس منافِسًا، بل الأقوى. وهذا ما وُجِدنا لبنائه، فلم يكن مفاجئًا لنا، لكن من الجيّد أن يؤكّده طرفٌ لا سبب لديه لمجاملتنا.

    2. المستندات الممسوحة ومنخفضة الدقّة

    العمل القانوني يقوم على ملفات PDF رديئة: عقود مُرسَلة بالفاكس، وملفات ممسوحة ضوئيًا، وصفحات مُصوَّرة. في المواد المصدرية الممسوحة والمصوَّرة والمُنقَّحة وغير المثالية، استوفى HAQQ 65.2% من المعايير ونجح في 33.3% من المهام كاملةً — أعلى من المتوسّط في كليهما. وكان أقدر على استخراج المحتوى المقروء مع الإشارة إلى ما تعذّرت قراءته، لأنه لا يعتمد على قارئ النصوص المدمج في النموذج، بل يشغّل قارئه الخاص.

    3. لم يختلق المعلومات

    تضمّن التقييم مهامًّا صُمِّمت لإغراء النموذج باختلاق ما ليس موجودًا: ملاحق مفقودة ومراجع غائبة. سجّل HAQQ 100% في نقطة التحقّق الخاصة بالمراجع المفقودة. فحين غابت ملاحق أساسية، حافظ باستمرار على الفجوة بدل اختلاق محتواها.

    تحفّظ صادق واحد، بدقّة: تلك الـ100% على مقياس واحد محدَّد — وهو إدراك أن مصدرًا مُشارًا إليه أو معلومةً مطلوبة غير متوفّرة ببساطة. أما على مهام مقاومة الهلوسة الأوسع في التقييم، فسجّل HAQQ 28.0% نجاحًا و61.7% من المعايير المستوفاة: أعلى من المتوسّط، لا الكمال. لا يوجد ذكاء اصطناعي خالٍ من الهلوسة كليًا. لكن اختلاق محتوى غائب هو تحديدًا نمط الفشل الذي يُنهي مسيرات المحامين، ولهذا هو ما نُوليه أقصى اهتمامنا.

    لماذا تُعدّ الهلوسة جوهر اللعبة في المجال القانوني

    في البرمجة السريعة، الهلوسة خطأ برمجي تكتشفه. أما في القانون، فالهلوسة قضيةٌ مزيّفة تُستشهَد بها أمام قاضٍ. وقد رأيت العناوين الصحفية. في عقدٍ أو مذكّرة قضائية، بندٌ واحد مختلَق أو إحالةٌ إلى قانون لا وجود له ليس عيبًا هامشيًا، بل سببٌ للاستبعاد.

    لذا فإن «صحيح في الغالب» ليس منتجًا. المعيار الحقيقي هو: هل يثق المحامي بالمُخرَج بما يكفي للبناء عليه؟ والاختبار المستقل على مهام المحتوى الغائب من الطرق النادرة الصادقة لقياس ذلك، وهو تحديدًا الموضع الذي بُني HAQQ ليكون قويًا فيه.

    العبرة في البنية لا في النموذج

    هذا هو التحوّل الذي يعيشه القطاع بأكمله: لم يعد النموذج هو الفائز. الجميع يستطيع استدعاء النماذج المتقدّمة نفسها. ما يفرّق بين منتجات الذكاء الاصطناعي القانوني اليوم هو البرمجيات المحيطة بالنموذج — الاسترجاع، والأدوات، والاستدلال، والبيانات.

    يعمل HAQQ على محرّكه الخاص، Justinian. تخيّله كـ«Palantir للعمل القانوني»: يتّصل بأنظمتك الحالية، ويبني بنية معرفية (Ontology) لقضاياك، ويُغلق الحلقة بين مستنداتك والإجابة.

    خلف الكواليس، يدير HAQQ ستة نماذج — اثنان مفتوحا المصدر وأربعة خاصّة — عبر مُوجِّه يقرأ كل طلب ويختار النموذج المناسب للمهمّة، موازنًا بين الدقّة والتكلفة، فلا يشغّل نموذجٌ واحد كل الأعمال. وحول النماذج تقع أدوات HAQQ الخاصة: المتصفّح، ومستخرِج PDF، وقارئ النصوص الضوئي. النماذج مكوّن واحد فقط؛ أما الاستخراج، وطبقة الاستشهاد، والتوجيه فهي من صنعنا. ولهذا يصمد أمام ملفات PDF الرديئة ويرفض الهلوسة حيث تفشل الأدوات الأبسط.

    ما لا يحلّه أحد غيرنا: الأسواق الناشئة

    القانون الأوروبي والأمريكي سهلٌ نسبيًا على الذكاء الاصطناعي. فهو مرقمَن، وموثَّق جيدًا، ومُستقصى بلا حدود. ولهذا يبدو كل أداة جيّدًا على عقدٍ بريطاني.

    الآن وجّه الأدوات نفسها إلى الشرق الأوسط، أو أمريكا الجنوبية، أو أجزاء من إفريقيا وآسيا. القانون هناك ليس مرقمَنًا بنظافة. وبيانات التدريب شحيحة. والنماذج تهلوس — نفس الفشل الذي تراه على المسائل الشرق أوسطية يظهر أينما كانت البيانات نادرة.

    بُني HAQQ لهذا تحديدًا. لقد دوّنّا واستخرجنا القوانين الأساسية لهذه الولايات القضائية بأنفسنا، وهو حصنٌ لا تملكه الأدوات القانونية العامّة. وأن نكون الأقوى في الشرق الأوسط في تقييمٍ مستقل ليس حظًّا، بل تصميمًا.

    ما الذي ينبغي أن تقيسه اختبارات الذكاء الاصطناعي القانوني مستقبلًا

    صقلت هذه التجربة رؤيتنا لما ينبغي أن يختبره أي تقييم للذكاء الاصطناعي القانوني. وفيما يلي أمور نرى أن المجال كله ينبغي أن يعتمدها:

    • المئين لا النجاح/الرسوب. «أعلى من المتوسّط» لا يقول لك شيئًا تقريبًا. فالمئين الخمسون والتاسع والتسعون كلاهما أعلى من المتوسّط، وهما ليسا المنتج نفسه. أظهِر موقع الأداة مقابل المقدّمة.
    • الصعوبة والقابلية للدفاع. توليد عقدٍ سهل البناء. أما قراءة ضوئية موثوقة عبر مسوحات رديئة، أو استخراج يستشهد بالبند الدقيق، فقد يستغرق بناؤه من 12 إلى 18 شهرًا. زِنْ صعوبة بناء القدرة، فهذا ما يفصل التقدّم الحقيقي عن العرض التوضيحي.
    • السعر والعائد. الجودة باتت شبه بديهية في القمّة الآن. السؤال الذي يطرحه المشترون فعلًا هو: بأي تكلفة؟ التكلفة لكل عقد، ولكل مهمّة بحث، ولكل صفحة. قِسْها، وكافئ المورّدين الشفّافين والميسورين.
    • استنتاج القصد. المستخدمون الحقيقيون لا يكتبون طلبات طويلة مثالية. يكتبون «صُغ اتفاقية عدم إفصاح» أو «راجع هذه المستندات». الأداة الجيّدة تستنتج مقصدهم وتصل إلى الإجابة دون عشر جولات من الأخذ والردّ — عكس روبوت المحادثة المضبوط على إبقائك تتحدّث.
    • الاستشهادات والمصادر المُوثَّقة. الويب مليء بقوانين قديمة. المهم هو: هل تستشهد الأداة بالنصّ المحدَّد والساري؟ وهنا يظهر الفارق بين نموذج لغوي عام وبرمجيات قانونية حقيقية أسرع ما يكون.
    • الاستدلال في المراجعة. في مراجعة العقود، القيمة ليست في التعديلات فحسب، بل في المقترحات، والسيناريوهات، ومسار التفكير الظاهر خلفها. قيّم ما إذا كانت الأداة تُظهر عملها.
    • معدّل الهلوسة في الصدارة. لكل الأسباب أعلاه، هذا هو الرقم الأهم للمحامين. مكانه العنوان الرئيسي، لا الهامش.

    ما التالي في هذا التقييم

    كانت هذه الجولة الأولى، وقد غطّت صياغة العقود واستخراج البيانات. وهناك المزيد قادم.

    HAQQ مُصنَّف حاليًا «مُنافِسًا» (Contender) للربع الثالث من 2026 في فئات الاعتماد الخمس كلها: أفضل تطبيق ذكاء اصطناعي قانوني (إجمالًا)، وصياغة العقود، واستخراج المعلومات، والفئة الأصعب، وتجربة المستخدم. ولنكن دقيقين في المعنى لأن الصياغة مهمّة: «مُنافِس» هو تصنيف جهة التقييم للتطبيق المشارك خلال الربع، ولا تُؤكَّد الاعتمادات إلا بعد انتهاء الربع. وإن لم يتجاوز أي تطبيق العتبة في فئة، فلا يُمنَح اعتماد فيها إطلاقًا. وسننشر أين نحلّ، فُزنا أم خسِرنا.

    الشهر المقبل يتوسّع التقييم إلى البحث والتحليل القانوني، ثم إلى مناطق أكثر، تتجاوز التركيز التقليدي على أمريكا وبريطانيا، إلى ولايات الأسواق الناشئة في أمريكا الجنوبية وإفريقيا وآسيا وجنوب شرق أوروبا. وهذه تحديدًا المناطق التي نركّز عليها. ويجري التقييم على وتيرة ربع سنوية، لأن النماذج تتطوّر بسرعة تجعل أي اختبار نصف قديم لحظة صدور اختبار جديد.

    النسخة الصادقة

    نحن فخورون بهذه النتيجة ولن نبالغ في تسويقها. نسبة نجاح إجمالية 27.0% عتبةٌ حقيقية جرى تجاوزها في اختبارٍ قاسٍ عمدًا — وتعني أيضًا أنه في نحو ثلاث من كل أربع مهام صعبة، بقي معيارٌ واحد على الأقل من وضع المحامين لم نستوفِه. كلا الجملتين صحيحة، ومن يقتبس الأولى دون الثانية يُسيء قراءة التقييم.

    كما لا يمكننا إخبارك كم نبعد عن الأداة الأفضل منفردة في المجال، لأن جهة التقييم لا تُظهر لنا المنافسين فُرادى قط — بل كمتوسّط فقط. وأن نكون أعلى من ذلك المتوسّط ليس كأن نكون الأول، ولن نُوحي بغير ذلك حتى تُنشَر الترتيبات. ما نعرفه: في العمل الذي يشبه الممارسة القانونية الحقيقية، وفي أصعب مهام المجموعة، وفي الولايات القضائية التي تتجاهلها معظم الأدوات، صمد HAQQ تحت مجهرٍ خارجي. وسنواصل الحضور في كل جولة ونشر ما تجده.

    • Justinian — المحرّك خلف هذه النتائج
    • كيف يقارَن HAQQ ببقية أدوات الذكاء الاصطناعي القانوني
    • تقييم قانوني على 300 مهمّة للنماذج المتقدّمة
    • تقييم HAQQ-LAB للقانون المدني / الشرق الأوسط

    جرّب HAQQ AI مجاناً

    اختبر الصياغة والبحث القانوني بالذكاء الاصطناعي

    H

    HAQQ Research

    Benchmark Series

    موارد ذات صلة

    Justinian — the engine behind these resultsHow HAQQ compares to other legal AI300-task frontier-model legal benchmarkHAQQ-LAB civil-law / MENA benchmark

    مقالات ذات صلة

    لماذا يخذل ChatGPT المحامين: ملاحظات من 3 محامين أمريكيين

    لماذا يخذل ChatGPT المحامين: ملاحظات من 3 محامين أمريكيين

    بدائل Spellbook: أفضل أدوات صياغة العقود بالذكاء الاصطناعي في 2026

    بدائل Spellbook: أفضل أدوات صياغة العقود بالذكاء الاصطناعي في 2026

    إحصاءات الذكاء الاصطناعي القانوني 2026: كم محامياً يستخدمه فعلاً

    إحصاءات الذكاء الاصطناعي القانوني 2026: كم محامياً يستخدمه فعلاً

    الأسئلة الشائعة

    Who ran the HAQQ legal AI benchmark?

    An independent third-party evaluator with no commercial stake in HAQQ, running a published methodology applied identically to every application in the cohort. We do not name the evaluator here. Their reports are private by default, but a vendor may publish its own results, which is why HAQQ's full numbers appear in this article while competing products are shown only as an aggregate average.

    How did HAQQ perform in the benchmark?

    HAQQ passed 27.0% of tasks overall and scored 2.53 out of 3 on form, above both the legal-AI average and the industry average. On contract drafting it passed 24.2% against 20.6% for the legal-AI average and 23.9% for general-purpose AI, with a form score of 2.56 against 2.44 for both. On data extraction it passed 30.0% against 29.6% and 29.3%. On The High Bar, the benchmark's hardest subset, it passed 5.9% against 1.1% for the average legal AI.

    What is The High Bar in the legal AI benchmark?

    The High Bar is the subset of tasks that no more than 2 of the 10 evaluated applications could complete: 34 tasks scored across 68 attempts. It exists to separate exceptional performance from ordinary competence. HAQQ passed 5.9% of those attempts, compared with 1.1% for the average legal AI and 2.2% for general-purpose AI — more than five times the legal-AI field. Absolute numbers are low by design, because these are tasks the whole industry fails.

    How is the legal AI benchmark scored?

    61 real tasks contributed by practising lawyers, across 21 jurisdictions, presented as native Word files, PDFs, scans and documents with tracked changes rather than pre-converted text. Every task has binary pass/fail criteria written by lawyers and fixed before testing, and a task passes only when every applicable criterion is met. Substance and form are scored separately and never blended. Every task is run twice independently, two LLM judges grade each output, and any disagreement that could change a pass is escalated to a qualified lawyer who reviews it blind.

    Does HAQQ hallucinate?

    HAQQ scored 100% on the benchmark's missing-reference checkpoint: when key schedules or referenced sources were unavailable, it preserved the gap instead of inventing the contents. On the broader hallucination-resistance tasks it passed 28.0% and met 61.7% of criteria, above average but not perfect. No AI is universally hallucination-free, but inventing absent content is the failure mode that matters most in law, and it is the one HAQQ is built to resist.

    What is the Justinian engine?

    Justinian is HAQQ's own hybrid architecture. It connects to your existing stack, builds an ontology of your matters, and orchestrates six models (two open-source, four proprietary) behind a router, with HAQQ's own OCR, extraction and citation tools around them. It does not rely on a model's built-in OCR, which is why it holds up on scanned and low-resolution documents.

    Is HAQQ good for Middle Eastern and emerging-market law?

    Yes. On drafting governed by Omani law, HAQQ produced the strongest results in the independent benchmark, at 50.0%. HAQQ has inscribed and extracted primary law for jurisdictions that are poorly digitized, across the Middle East and other emerging markets, where general-purpose tools tend to hallucinate.

    Can I see HAQQ's benchmark score?

    Yes. HAQQ's own results are published in full: 27.0% overall pass rate, 2.53 out of 3 on form, 24.2% on contract drafting, 30.0% on data extraction and 5.9% on The High Bar. Competing legal AI products appear only as an aggregate average, because the evaluator does not disclose any application's individual result to another vendor.

    Has HAQQ been certified by the benchmark?

    Not yet. HAQQ is currently designated a Contender for Q3 2026 in all five certification categories: Best Legal AI Application (Overall), Contract Drafting, Information Extraction, The High Bar, and User Experience. Contender is the evaluator's in-quarter designation; certifications are confirmed only when the quarter closes, and if no application clears the threshold in a category, no certification is awarded there.

    ما التالي؟

    جرّب HAQQ AI مجاناً

    اختبر الصياغة والبحث القانوني بالذكاء الاصطناعي

    احسب عائد الاستثمار

    اكتشف كم من الوقت والمال يوفره HAQQ لمكتبك

    تصفح 380+ أمر قانوني

    أوامر جاهزة للاستخدام لكل مهمة قانونية

    العودة للمدونة

    المقال السابق

    أسعار الذكاء الاصطناعي القانوني في 2026: كل سعر مُعلَن، وكل مزوّد لا يُعلن شيئاً

    ضع هذا موضع التنفيذ

    اسأل HAQQ السؤال الذي أثاره هذا المقال لديك.

    HAQQ across all devices
    HAQQ Legal AI Platform Logo

    توأمك القانوني بالذكاء الاصطناعي ونظام إدارة المكتب للصياغة والفوترة والفوز.

    Download on theApp StoreGet it onGoogle Play

    المنتج

    • دردشة HAQQ القانونية الذكية
    • HAQQ eFirm
    • تطبيق الجوال
    • HAQQ eBar
    • HAQQ eWallet
    • محرك جستنيان الذكي
    • HAQQ للمؤسسات
    • الأمان
    • الأسعار

    الحلول

    • جميع الحلول
    • حسب الدور
    • لك
    • حسب حالة الاستخدام
    • حسب الميزة
    • حسب حجم المكتب
    • حسب الدولة
    • حسب المدينة
    • متخصصة
    • قارننا
    • حاسبة العائد على الاستثمار

    الموارد

    • المدونة
    • أكاديمية HAQQ
    • مكتبة الأوامر
    • مكتبة البنود
    • مكتبة الوثائق
    • مهارات الذكاء الاصطناعي القانوني
    • أدوات مجانية
    • مؤشر الذكاء الاصطناعي القانوني
    • سجل التحديثات
    • الحالة

    الشركة

    • تعرف على الفريق
    • الوظائف
    • الصحافة والفعاليات
    • الشراكة
    • الطلاب
    • برنامج الشركات الناشئة
    • اتصل بنا
    • الدعم
    • اللغاتar en fr es it de pt
    • التواصلinfo@haqq.ai
    • الحالةيعمل·راسخ
    • شروط الخدمة
    • سياسة الخصوصية
    • سياسة ملفات تعريف الارتباط
    • معالجة البيانات
    • humans.txtlawyers.txtsecurity.txt
    © 2026 HAQQ Inc. جميع الحقوق محفوظة.المنتج مطوّر داخلياً بالكامل من قبل HAQQ. الموقع الإلكتروني مبني بأدوات ويب حديثة.