اختبار سريع يظهر أن محركات البحث المدعومة بالذكاء الاصطناعي قد تبدو واثقة بينما تستشهد بمصادر معطلة أو منخفضة الجودة

كشف فحص بسيط لموثوقية المصدر (provenance) في ثلاث أدوات بحث شهيرة مدعومة بالذكاء الاصطناعي أن اثنتين منها إما أشارت إلى روابط معطلة أو دعمت إجاباتها بمواقع منخفضة المصداقية، على الرغم من أن الأدوات الثلاث عرضت نفس الأسلوب الواثق وصفاً من "بطاقات" المصادر (source chips).

الاختبار الذي أثار المفاجأة

طرحت سؤالاً واقعياً وحديثاً: “What changed in the EU AI Act in 2026?” (ما الذي تغير في قانون الذكاء الاصطناعي للاتحاد الأوروبي في عام 2026؟). الإجابة موجودة في نص التعديل الرسمي، لذا فهي إما موجودة أو غير موجودة. قمت بتوجيه الاستعلام إلى ثلاثة محركات بحث تعمل بالذكاء الاصطناعي وتظهر الاستشهادات: Perplexity، ووضع الذكاء الاصطناعي في Google، وBrave Search.

أعادت المحركات الثلاثة حقائق متطابقة — نفس التواريخ، ونفس الوصف — لذا تعادلت في دقة المعلومات المجردة. ولم يظهر الاختلاف إلا عندما فحصت المصادر المستشهد بها.

كيف قيمت جودة المصادر

أنشأت نظام تسجيل من ثلاث فئات يزن كل استشهاد حسب نوع المضيف:

  • أساسي (الوزن 3) – الموقع الذي ينشر القانون فعلياً (مثل السجل الرسمي للاتحاد الأوروبي).
  • رسمي (الوزن 2) – المؤسسة التي تصدر القانون أو تشرف عليه (النطاقات الحكومية، مواقع الوكالات).
  • محتوى من إنشاء المستخدمين (UGC، الوزن 0) – منصات مثل YouTube أو Reddit.

الدرجة الإجمالية لكل محرك هي متوسط وزن عناوين URL التي عرضها.

المحرك المصادر المبلغ عنها الدرجة
Perplexity نطاقات حكومية رسمية 2.00
Google AI mode شركات استشارية وفيديو YouTube 1.00
Brave Search مصدر أساسي 3.00

نظرياً، بدا Brave مثالياً، وPerplexity جيداً، بينما تأخر Google في الخلف.

الفشل الخفي: الروابط المعطلة

خريطة الفئات تنظر فقط إلى اسم النطاق؛ فهي لا تتحقق مما إذا كانت الصفحة المرتبطة تعمل بالفعل. قمت باتباع كل عنوان URL. أدى الاستشهاد "الأساسي" في Brave إلى صفحة فارغة — كان الرابط معطلاً. ادعى المحرك أنه يشير إلى القانون ولكنه لم يقدم شيئاً.

استخدم Perplexity نطاقات حكومية رسمية.

استخدم Google شركات استشارية وفيديو YouTube.

ظهرت مشكلتان متميزتان:

  1. النطاق عالي الجودة لا يضمن وصولاً إلى صفحة تعمل.
  2. يمكن أن يكون الملخص المصاغ جيداً مدعوماً بمصادر منخفضة المصداقية.

تخفي واجهة المستخدم كلتا المشكلتين. تعرض الأدوات الثلاث الفقرة الواثقة نفسها وصفاً موحداً من بطاقات المصادر، دون أي إشارة مرئية إلى أن إحدى البطاقات ترتبط بصفحة معطلة أو أن أخرى تشير إلى درس تعليمي على YouTube بدلاً من النص التشريعي.

لماذا تهم موثوقية المصدر المطورين

يمكن للمطورين تحويل موثوقية المصدر إلى مقياس قابل للاختبار:

  • تقييم كل إجابة باستخدام أوزان متدرجة مشابهة لما سبق.
  • التحقق من سلامة الروابط تلقائياً؛ وتحديد الاستجابات الفارغة أو أخطاء HTTP.
  • تفعيل التنبيهات عندما تنخفض درجة موثوقية مصدر الإجابة عن حد قابل للضبط.

هذا النهج أكثر واقعية من مطاردة "الهلوسة" (hallucinations) – فقد يولد النموذج جملة تبدو منطقية، لكن فحص موثوقية المصدر يخبرك بالضبط أي استشهاد (أو عدم وجود استشهاد) تسبب في المشكلة، مما يسمح بإجراء إصلاح مستهدف.

الخلاصة

يظهر اختبار قصير لموثوقية المصدر أن محركات البحث المدعومة بالذكاء الاصطناعي يمكن أن تبدو موثوقة بينما تستشهد بمصادر معطلة أو منخفضة الجودة. يجب على المطورين الذين يعتمدون على هذه المحركات التعامل مع جودة الاستشهاد كخاصية قابلة للقياس، وليس كضمان مفترض، وبناء فحوصات آلية في مسارات عملهم (pipelines). إن التحقق من أن المصدر "الأساسي" يعمل بالفعل قد يكون هو الفارق بين إجابة جديرة بالثقة وفخ صامت من المعلومات المضللة.