ایک فوری ٹیسٹ سے معلوم ہوا ہے کہ AI سرچ انجن مردہ یا کم معیار کے ذرائع کا حوالہ دیتے ہوئے بھی پراعتماد معلوم ہو سکتے ہیں

تین مقبول AI سے چلنے والے سرچ ٹولز پر ماخذ (provenance) کی ایک سادہ جانچ سے معلوم ہوا کہ ان میں سے دو نے یا تو مردہ لنکس کی طرف اشارہ کیا یا اپنے جوابات کو کم ساکھ والی سائٹس سے ثابت کیا، باوجود اس کے کہ تینوں نے ایک ہی طرح کا پراعتماد متن اور ذرائع کے "چپس" (chips) کی ایک قطار دکھائی۔

وہ ٹیسٹ جس نے حیرت میں ڈال دیا

میں نے ایک حقائق پر مبنی، حالیہ سوال پوچھا: “2026 میں EU AI Act میں کیا تبدیلی آئی؟” اس کا جواب سرکاری ترمیم شدہ متن میں موجود ہے، اس لیے یا تو وہ وہاں ہے یا نہیں۔ میں نے یہ سوال تین ایسے AI سرچ انجنوں کو دیا جو حوالہ جات (citations) فراہم کرتے ہیں: Perplexity، Google کا AI موڈ، اور Brave Search۔

تینوں نے یکساں حقائق فراہم کیے—وہی تاریخیں، وہی تفصیل—چنانچہ درستگی کے لحاظ سے وہ برابر رہے۔ فرق صرف اس وقت سامنے آیا جب میں نے دیے گئے ذرائع کا جائزہ لیا۔

میں نے ذرائع کے معیار کا فیصلہ کیسے کیا

میں نے اسکورنگ کا ایک تین درجوں والا نظام بنایا جس میں ہر حوالے کو ہوسٹ کی قسم کے لحاظ سے وزن (weight) دیا گیا:

  • بنیادی (وزن 3) – وہ سائٹ جو اصل میں قانون شائع کرتی ہے (مثلاً، آفیشل EU رجسٹر)۔
  • سرکاری (وزن 2) – وہ ادارہ جو قانون جاری کرتا ہے یا اس کی نگرانی کرتا ہے (سرکاری ڈومینز، ایجنسی سائٹس)۔
  • صارفین کا تیار کردہ مواد (UGC, وزن 0) – یوٹیوب یا ریڈٹ (Reddit) جیسے پلیٹ فارمز۔

ہر انجن کا مجموعی اسکور ان URLs کا اوسط وزن ہے جو اس نے دکھائے۔

انجن رپورٹ شدہ ذرائع اسکور
Perplexity سرکاری حکومتی ڈومینز 2.00
Google AI mode کنسلٹنگ فرمز اور ایک یوٹیوب ویڈیو 1.00
Brave Search بنیادی ذریعہ 3.00

کاغذ پر Brave بہترین نظر آیا، Perplexity مناسب تھا، اور Google پیچھے رہ گیا۔

پوشیدہ ناکامی: مردہ لنکس

درجوں کا نقشہ صرف ڈومین کے نام کو دیکھتا ہے؛ یہ اس بات کی تصدیق نہیں کرتا کہ لنک کیا گیا صفحہ اصل میں لوڈ ہو رہا ہے یا نہیں۔ میں نے ہر URL کو چیک کیا۔ Brave کے "بنیادی" حوالے نے خالی صفحہ دکھایا—لنک مردہ تھا۔ انجن نے قانون کی طرف اشارہ کرنے کا دعویٰ کیا لیکن کچھ فراہم نہ کیا۔

Perplexity نے سرکاری حکومتی ڈومینز کا استعمال کیا۔

Google نے کنسلٹنسی فرمز اور ایک یوٹیوب ویڈیو کا استعمال کیا۔

دو واضح مسائل سامنے آئے:

  1. ایک اعلیٰ معیار کا ڈومین قابل رسائی صفحے کی ضمانت نہیں دیتا۔
  2. ایک بہترین طریقے سے تیار کردہ خلاصہ کم ساکھ والے ذرائع پر مبنی ہو سکتا ہے۔

یوزر انٹرفیس (UI) ان دونوں مسائل کو چھپا دیتا ہے۔ تینوں ٹولز ایک ہی پراعتماد پیراگراف اور ذرائع کے چپس کی ایک یکساں قطار پیش کرتے ہیں، بغیر کسی بصری اشارے کے کہ ایک چپ مردہ صفحے سے منسلک ہے یا کوئی دوسری قانونی متن کے بجائے یوٹیوب ٹیٹوریل کی طرف اشارہ کر رہی ہے۔

ڈویلپرز کے لیے ماخذ (provenance) کیوں اہم ہے

ڈویلپرز ماخذ کو ایک قابلِ آزمائش پیمانے (metric) میں بدل سکتے ہیں:

  • ہر جواب کو اسکور کریں اوپر دیے گئے طریقے کے مشابہہ درجوں والے وزن کا استعمال کرتے ہوئے ۔
  • لنک کی صحت کی خودکار تصدیق کریں؛ خالی جوابات یا HTTP غلطیوں کو نشان زد کریں۔
  • الرٹس (alerts) جاری کریں جب کسی جواب کا ماخذ اسکور مقررہ حد سے نیچے گر جائے۔

یہ طریقہ کار "ہیلوسینیشنز" (hallucinations) کے پیچھے بھاگنے سے زیادہ ٹھوس ہے – ماڈل شاید ایک معقول جملہ تیار کر لے، لیکن ماخذ کی جانچ آپ کو بالکل صحیح بتاتی ہے کہ کس حوالے (یا اس کی عدم موجودگی) نے مسئلہ پیدا کیا، جس سے نشانے پر اصلاح ممکن ہو جاتی ہے۔

خلاصہ

ماخذ کا ایک مختصر ٹیسٹ ظاہر کرتا ہے کہ AI سرچ انجن مردہ یا کم معیار کے ذرائع کا حوالہ دیتے ہوئے بھی مستند معلوم ہو سکتے ہیں۔ وہ ڈویلپرز جو ان انجنوں پر انحصار کرتے ہیں، انہیں حوالے کے معیار کو ایک پیمائش کے قابل خصوصیت کے طور پر دیکھنا چاہیے، نہ کہ ایک مفروضہ ضمانت کے طور پر، اور اپنے پائپ لائنز (pipelines) میں خودکار چیک شامل کرنے چاہئیں۔ یہ تصدیق کرنا کہ ایک "بنیادی" ذریعہ اصل میں لوڈ ہو رہا ہے، ایک قابل اعتماد جواب اور خاموش غلط معلومات کے جال کے درمیان فرق ہو سکتا ہے۔