Anthropic کے Claude میں ایک پرائیویسی کمزوری سامنے آئی ہے: نجی گفتگو اور "Artifacts" گوگل پر تلاش کے قابل ہو گئے ہیں۔ یہ واقعہ AI کے دور میں صارف کے ذریعے شیئرنگ اور ویب انڈیکسنگ کے درمیان ٹکراؤ کو ظاہر کرتا ہے۔
انکشاف کا طریقہ کار
Reddit صارفین نے site:claude.ai/share جیسے گوگل آپریٹرز کا استعمال کرتے ہوئے اس خلاف ورزی کا پتہ لگایا، جس نے "share chat" فیچر کی مطلوبہ پرائیویسی کو نظر انداز کر دیا۔ Claude خبردار کرتا ہے کہ "لنک رکھنے والا کوئی بھی اسے دیکھ سکتا ہے،" لیکن اس فیچر کا مقصد مخصوص لوگوں کے ساتھ شیئرنگ ہے، نہ کہ عالمی سطح پر دکھانا۔
Google Docs کے برعکس، جو ڈیفالٹ کے طور پر کرالرز (crawlers) کو بلاک کرتا ہے، Claude کے شیئر شدہ URLs کو گوگل نے انڈیکس کر لیا، جس سے کوئی بھی عام سرچ کے ذریعے حساس معلومات تک پہنچ سکتا ہے۔
حساس ڈیٹا اور خطرے میں پڑا مواد
Futurism اور TechCrunch جیسے ذرائع نے رپورٹ کیا کہ انڈیکس شدہ نتائج میں درج ذیل چیزیں شامل تھیں:
- ذاتی طور پر شناخت کے قابل معلومات (PII): پرائمری اسکول کی عمر کے بچوں کے نام اور فون نمبر۔
- میڈیکل ریکارڈز: کلینیکل ٹرائل کے تفصیلی نتائج اور حقیقی مریضوں کی رپورٹس۔
- کارپوریٹ انٹیلی جنس: "صرف اندرونی استعمال کے لیے" (internal use only) کے طور پر نشان زدہ دستاویزات اور ملازمین کی کارکردگی کے جائزے (performance reviews)۔
- تکنیکی اثاثے: Claude کے "Artifacts" فیچر سے کوڈ اسنیپٹس (code snippets) اور کام کے نوٹس۔
کچھ انکشاف شدہ چیٹس Anthropic کے حفاظتی فلٹرز سے بھی بچ نکلیں، جن میں جنسی طور پر واضح مواد (sexually explicit content) نظر آیا اور اس سے ماڈریشن کے حوالے سے مزید خدشات پیدا ہوئے۔
Anthropic اور Google کا ردعمل
Anthropic نے اپنے آرکیٹیکچر کا دفاع کرتے ہوئے کہا کہ وہ سرچ انجنوں کے ساتھ چیٹ ڈائریکٹریز یا سائٹ میپس شیئر نہیں کرتا۔ ترجمان Amie Rotherham نے وضاحت کی کہ شیئر لنکس سرچ کے نتائج میں صرف اس وقت ظاہر ہوتے ہیں جب صارفین انہیں بیرونی، کرال کرنے کے قابل (crawlable) پلیٹ فارمز پر پوسٹ کرتے ہیں، اور یہ URLs "اندازے سے معلوم نہیں کیے جا سکتے" (not guessable)۔ ایک بار جب کوئی لنک "عام استعمال میں آ جائے" (out in the wild)، تو اسے تیسرے فریق محفوظ (archive) کر سکتے ہیں۔
Google کے ترجمان Ned Adriance نے بھی یہی کہا کہ سرچ انجن ہر اس چیز کو انڈیکس کرتے ہیں جو انہیں مل سکتی ہے، جب تک کہ سائٹ کے مالکان واضح طور پر کرالنگ کو بلاک نہ کر دیں۔ تجربات سے پتہ چلتا ہے کہ اس انکشاف کو گوگل کے انڈیکس سے ہٹا دیا گیا ہے، لیکن گزشتہ سال بھی ایک اسی طرح کے واقعے میں سینکڑوں Claude چیٹس انڈیکس ہو گئی تھیں۔
یہ AI صارفین کے لیے کیوں اہم ہے
LLMs کو ضم کرنے والے ڈویلپرز اور بانیوں کو "شیئر شدہ لنکس" کو عوامی (public) سمجھنا چاہیے، نہ کہ محفوظ۔ جیسے جیسے AI ٹولز ذاتی اسسٹنٹ سے بدل کر کاروباری ساتھی (enterprise collaborators) بن رہے ہیں، عوامی ویب مواد اور نجی ڈیٹا کے درمیان فرق کے لیے صرف ٹول ٹپ وارننگ کافی نہیں بلکہ تکنیکی نفاذ کی ضرورت ہے۔
اہم نکات
- اپنی سیٹنگز کا جائزہ لیں: Claude میں Settings → Privacy → Shared Chats پر جائیں اور تمام فعال عوامی لنکس کو منسوخ کر دیں۔
- شیئر لنکس کو عوامی سمجھیں: فرض کریں کہ AI کے ذریعے تیار کردہ کوئی بھی لنک سرچ انجنوں کے ذریعے انڈیکس کیا جا سکتا ہے۔
- کاروباری احتیاط: ملکیتی کوڈ یا حساس PII کے حادثاتی اخراج کو روکنے کے لیے "share" فیچرز کے حوالے سے سخت پالیسیاں نافذ کریں۔
Anthropic کے Claude AI پلیٹ فارم نے نادانستہ طور پر نجی چیٹس اور "Artifacts" کو انکشاف کا شکار کر دیا جب گوگل نے اس کے شیئر-لنک URLs کو انڈیکس کر لیا، جس سے حساس گفتگو تلاش کے قابل ہو گئی۔ Reddit صارفین نے سائٹ سے متعلقہ گوگل کوئری کے ذریعے اس لیک کا پتہ لگایا، جس سے ذاتی، طبی اور کارپوریٹ ڈیٹا سامنے آگیا۔
انکشاف کیسے ہوا
Claude کا "share chat" فیچر ایک ایسا URL تیار کرتا ہے جس کے بارے میں انٹرفیس خبردار کرتا ہے کہ اسے کوئی بھی دیکھ سکتا ہے جس کے پاس یہ ہو۔ اس کا مقصد لنک کسی ساتھی کو دینا ہے، نہ کہ اسے عام کرنا۔ چونکہ URLs claude.ai/share ڈومین کے تحت آتے ہیں، اس لیے کسی بھی عوامی طور پر کرال کرنے والی سائٹ—جیسے فورمز، سوشل میڈیا، یا Reddit کمنٹ—پر لنک پوسٹ کرنے سے گوگل کا کرالر اس کا پیچھا کر سکتا ہے۔
Reddit صارفین نے گوگل پر site:claude.ai/share تلاش کر کے اس مسئلے کا پتہ لگایا، جس کے نتیجے میں وہ گفتگو سامنے آئی جو نجی رہنی چاہیے تھی۔ Google Docs کے برعکس، جس کے شیئر شدہ لنکس ڈیفالٹ کے طور پر انڈیکسنگ سے محفوظ ہوتے ہیں، Claude کے لنکس میں اس حفاظتی تدبیر کی کمی تھی، جس کی وجہ سے سرچ انجن انہیں کیٹلاگ کرنے میں کامیاب رہا۔
کیا انکشاف ہوا
متعدد ذرائع نے رپورٹ کیا کہ انڈیکس شدہ نتائج میں درج ذیل چیزیں شامل تھیں:
- ذاتی طور پر شناخت کے قابل معلومات (PII): پرائمری اسکول کی عمر کے بچوں کے نام اور فون نمبر۔
- میڈیکل ریکارڈز: کلینیکل ٹرائل کا تفصیلی ڈیٹا اور حقیقی مریضوں کی رپورٹس۔
- کارپوریٹ انٹیلی جنس: "صرف اندرونی استعمال کے لیے" (internal use only) کے طور پر نشان زدہ دستاویزات، ملازمین کی کارکردگی کے جائزے، اور دیگر ملکیتی معلومات۔
- تکنیکی اثاثے: Claude کے "Artifacts" فیچر کے اندر تیار کردہ کوڈ اسنیپٹس، کام کے نوٹس، اور دیگر آرٹی فیکٹس۔
کچھ معاملات میں، عوامی طور پر نظر آنے والی چیٹس میں ایسا مواد بھی شامل تھا جو Anthropic کے حفاظتی فلٹرز سے بچ نکلا اور جنسی طور پر واضح مواد (sexually explicit material) پیدا ہوا۔
Anthropic کا ردعمل
Anthropic کا موقف ہے کہ وہ سرچ انجنوں کے لیے چیٹ ڈائریکٹریز یا سائٹ میپس (sitemaps) شائع نہیں کرتا۔ کمپنی کے ایک ترجمان نے وضاحت کی کہ شیئر کیے گئے لنکس سرچ رزلٹس میں صرف اس صورت میں نظر آتے ہیں جب کوئی صارف کسی بیرونی اور کرال کرنے کے قابل (crawlable) پلیٹ فارم پر یو آر ایل (URL) پوسٹ کرتا ہے، اور اس بات پر زور دیا کہ یہ یو آر ایل "اندازے سے معلوم کرنے کے قابل نہیں" ہیں۔ ایک بار جب کوئی لنک جان بوجھ کر آن لائن شیئر کر دیا جائے، تو کمپنی تھرڈ پارٹی آرکائیونگ (archiving) کو کنٹرول نہیں کر سکتی۔
Google کا موقف
Google نے اس بات کا اعادہ کیا کہ وہ یہ فیصلہ نہیں کرتا کہ کون سا مواد عوامی ہے؛ وہ اس چیز کو انڈیکس کرتا ہے جو اسے مل سکتی ہے، جب تک کہ کوئی سائٹ واضح طور پر کرالنگ (crawling) کو بلاک نہ کر دے۔ کمپنی نے کہا کہ وہ robots.txt یا میٹا ٹیگز (meta tags) جیسی ہدایات کا احترام کرتی ہے جو اخراج کی درخواست کرتی ہیں۔ واقعے کے بعد ابتدائی تجربات سے پتہ چلتا ہے کہ انکشاف شدہ یو آر ایل گوگل کے انڈیکس سے ہٹا دیے گئے ہیں، اگرچہ Google نے مستقل حل کی تصدیق نہیں کی۔
یہ AI صارفین کے لیے کیوں اہم ہے
یہ واقعہ ایک وسیع تر خطرے کو اجاگر کرتا ہے کیونکہ لارج لینگویج ماڈلز (large language models) ذاتی معاونین سے نکل کر کاروباری ورک فلو (enterprise workflows) کا حصہ بن رہے ہیں۔ ایک "شیئر کرنے کے قابل لنک" (shareable link) سہولت کا ایک ایسا ذریعہ ہے جسے کوئی بھی کرالر حاصل کر سکتا ہے۔ ریگولیٹڈ ڈیٹا—جیسے صحت کے ریکارڈ، ملازمین کی کارکردگی کی جانچ، اور ملکیتی کوڈ (proprietary code)—سنبھالنے والی تنظیموں کے لیے یہ مفروضہ کہ لنک محفوظ ہے کیونکہ یہ "صرف شیئر کیا گیا ہے"، مہنگے ڈیٹا لیک کا باعث بن سکتا ہے۔
جوابی دلیل: پلیٹ فارم کی حدود
Anthropic کا استدلال ہے کہ ذمہ داری ان صارفین پر عائد ہوتی ہے جو لنک شائع کرتے ہیں۔ پلیٹ فارم خبردار کرتا ہے کہ یو آر ایل رکھنے والا کوئی بھی شخص مواد دیکھ سکتا ہے اور یہ یو آر ایل کسی عوامی ڈائریکٹری میں ظاہر نہیں کرتا۔ Google اس کے جواب میں کہتا ہے کہ وہ سامنے آنے والے ہر نجی لنک کی نگرانی نہیں کر سکتا؛ اس کا کردار سرچ رزلٹس سے دور رہنے کے لیے سائٹ مالکان کی درخواستوں کا احترام کرنا ہے۔
دونوں موقف تکنیکی طور پر درست ہیں، پھر بھی وہ ایک خلا چھوڑتے ہیں: صارف کا تجربہ انڈیکسنگ کے خطرے کو واضح نہیں کرتا، اور پلیٹ فارم شیئر کیے گئے صفحات پر خودکار طور پر "no-index" ہدایات لاگو نہیں کرتا۔ اس لیے حادثاتی طور پر عوامی سطح پر انکشاف کو روکنے کا بوجھ ان صارفین پر پڑتا ہے جنہیں شاید یہ احساس نہ ہو کہ ایک سادہ سرچ کوئری کے ذریعے لنک کتنی آسانی سے دریافت کیا جا سکتا ہے۔
آگے کیا نظر آئے گا
صارفین کے لیے عملی اقدامات
- فعال لنکس کا آڈٹ کریں: Claude کی سیٹنگز کھولیں، شیئر شدہ چیٹس کے لیے پرائیویسی سیکشن پر جائیں، اور ان تمام یو آر ایل کو منسوخ کر دیں جن کی اب آپ کو ضرورت نہیں ہے۔
- ہر شیئر لنک کو عوامی سمجھیں: یہ فرض کر لیں کہ ایک بار جب کوئی لنک آن لائن کہیں بھی پوسٹ کر دیا جائے، تو اسے انڈیکس کیا جا سکتا ہے جب تک کہ اسے واضح طور پر بلاک نہ کیا جائے۔
- کاروباری کنٹرولز: ایسے مانیٹرنگ ٹولز استعمال کریں جو "PII," "confidential," یا "internal" جیسے کلیدی الفاظ پر مشتمل شیئر لنکس کی تخلیق پر نشان دہی کریں، اور ایسے لنکس کے کارپوریٹ نیٹ ورک سے باہر جانے سے پہلے منظوری کے ورک فلو (approval workflows) کو نافذ کریں۔
Claude کا واقعہ ہمیں یاد دلاتا ہے کہ فوری شیئرنگ کی سہولت ایک نقصان دہ عنصر (liability) بن سکتی ہے جب ویب ان لنکس کو عام صفحات کے طور پر دیکھتی ہے۔ جب تک پلیٹ فارمز خودکار طور پر شیئر شدہ یو آر ایل کا تحفظ نہیں کرتے، صارفین کو ہوشیار رہنا چاہیے۔
