Anthropic के Claude के साथ एक गोपनीयता संबंधी खामी सामने आई है: निजी बातचीत और "Artifacts" Google पर खोजने योग्य बन गए। यह घटना AI युग में उपयोगकर्ता-संचालित साझाकरण (sharing) और वेब इंडेक्सिंग के बीच के टकराव को दर्शाती है।

खुलासे का तंत्र

Reddit उपयोगकर्ताओं ने site:claude.ai/share जैसे Google ऑपरेटर्स का उपयोग करके इस उल्लंघन का पता लगाया, जिसने "share chat" फीचर की इच्छित गोपनीयता को दरकिनार कर दिया। Claude चेतावनी देता है कि "जिसके पास भी लिंक है वह इसे देख सकता है," लेकिन यह फीचर लक्षित साझाकरण के लिए है, वैश्विक दृश्यता के लिए नहीं।

Google Docs के विपरीत, जो डिफ़ॉल्ट रूप से क्रॉलर्स को रोकता है, Claude के साझा किए गए URL को Google द्वारा इंडेक्स कर लिया गया था, जिससे कोई भी सामान्य खोज के माध्यम से संवेदनशील जानकारी तक पहुँच सकता था।

जोखिम में संवेदनशील डेटा और सामग्री

Futurism और TechCrunch जैसे आउटलेट्स ने रिपोर्ट किया कि इंडेक्स किए गए परिणामों में शामिल थे:

  • व्यक्तिगत रूप से पहचान योग्य जानकारी (PII): प्राथमिक विद्यालय की उम्र के बच्चों के नाम और फोन नंबर।
  • मेडिकल रिकॉर्ड: विस्तृत क्लिनिकल-ट्रायल परिणाम और वास्तविक रोगी रिपोर्ट।
  • कॉर्पोरेट इंटेलिजेंस: "internal use only" (केवल आंतरिक उपयोग के लिए) चिह्नित दस्तावेज़ और कर्मचारियों की प्रदर्शन समीक्षा।
  • तकनीकी संपत्तियां: Claude के "Artifacts" फीचर से कोड स्निपेट्स और कार्य नोट्स।

कुछ उजागर चैट Anthropic के सुरक्षा फिल्टरों से भी बच निकलीं, जिनमें यौन रूप से स्पष्ट सामग्री दिखाई दी और इससे मॉडरेशन संबंधी चिंताएं और बढ़ गईं।

Anthropic और Google की प्रतिक्रिया

Anthropic ने अपने आर्किटेक्चर का बचाव करते हुए कहा कि वह सर्च इंजन के साथ चैट डायरेक्टरी या साइटमैप साझा नहीं करता है। प्रवक्ता Amie Rotherham ने समझाया कि शेयर लिंक खोज परिणामों में तभी दिखाई देते हैं जब उपयोगकर्ता उन्हें बाहरी, क्रॉल करने योग्य प्लेटफार्मों पर पोस्ट करते हैं, और ये URL "अनुमान लगाने योग्य नहीं" (not guessable) होते हैं। एक बार जब लिंक "सार्वजनिक रूप से उपलब्ध" (out in the wild) हो जाता है, तो इसे तीसरे पक्ष द्वारा आर्काइव किया जा सकता है।

Google के प्रवक्ता Ned Adriance ने भी यही कहा कि सर्च इंजन जो कुछ भी उन्हें मिल सकता है उसे इंडेक्स करते हैं, जब तक कि साइट मालिक स्पष्ट रूप से क्रॉलिंग को ब्लॉक न करें। परीक्षणों से पता चलता है कि इस खुलासे को Google के इंडेक्स से हटा दिया गया है, लेकिन पिछले साल की एक समान घटना में भी सैकड़ों Claude चैट इंडेक्स हो गई थीं।

AI उपयोगकर्ताओं के लिए यह क्यों महत्वपूर्ण है

LLMs को एकीकृत करने वाले डेवलपर्स और संस्थापकों को "साझा लिंक" (shared links) को सार्वजनिक मानना चाहिए, सुरक्षित नहीं। जैसे-जैसे AI उपकरण व्यक्तिगत सहायकों से एंटरप्राइज सहयोगियों में बदल रहे हैं, सार्वजनिक वेब सामग्री और निजी डेटा के बीच की रेखा के लिए केवल टूलटिप चेतावनी ही नहीं, बल्कि तकनीकी प्रवर्तन (technical enforcement) की आवश्यकता है।

मुख्य बातें

  • अपनी सेटिंग्स की जांच करें: Claude में Settings → Privacy → Shared Chats पर जाएं और किसी भी सक्रिय सार्वजनिक लिंक को रद्द करें।
  • शेयर लिंक को सार्वजनिक मानें: मान लें कि AI-जनरेटेड किसी भी लिंक को सर्च इंजन द्वारा इंडेक्स किया जा सकता है।
  • एंटरप्राइज सावधानी: मालिकाना कोड या संवेदनशील PII के आकस्मिक रिसाव को रोकने के लिए "share" फीचर्स के आसपास सख्त नीतियां लागू करें।

Anthropic के Claude AI प्लेटफॉर्म ने अनजाने में निजी चैट और "Artifacts" को उजागर कर दिया क्योंकि Google ने इसके शेयर-लिंक URL को इंडेक्स कर लिया था, जिससे संवेदनशील बातचीत खोजने योग्य हो गई। Reddit उपयोगकर्ताओं ने साइट-विशिष्ट Google क्वेरी के साथ इस लीक का पता लगाया, जिससे व्यक्तिगत, चिकित्सा और कॉर्पोरेट डेटा उजागर हो गया।

खुलासा कैसे हुआ

Claude का "share chat" फीचर एक URL जेनरेट करता है जिसके लिए इंटरफ़ेस चेतावनी देता है कि इसे कोई भी देख सकता है जिसके पास यह है। इसका उद्देश्य लिंक किसी सहकर्मी को देना है, न कि इसे प्रसारित करना। चूंकि URL claude.ai/share डोमेन के अंतर्गत आते हैं, इसलिए किसी भी सार्वजनिक रूप से क्रॉल करने योग्य साइट—फोरम, सोशल मीडिया, या Reddit कमेंट—पर लिंक पोस्ट करने से Google का क्रॉलर उसका अनुसरण कर सकता है।

Reddit उपयोगकर्ताओं ने Google पर site:claude.ai/share खोजकर इस समस्या का पता लगाया, जिसने उन बातचीत को वापस ला दिया जिन्हें निजी रहना चाहिए था। Google Docs के विपरीत, जिसके साझा लिंक डिफ़ॉल्ट रूप से इंडेक्सिंग से सुरक्षित होते हैं, Claude के लिंक में उस सुरक्षा की कमी थी, जिससे सर्च इंजन उन्हें सूचीबद्ध (catalog) करने में सक्षम हो गया।

क्या उजागर हुआ

कई आउटलेट्स ने रिपोर्ट किया कि इंडेक्स किए गए परिणामों में शामिल थे:

  • व्यक्तिगत रूप से पहचान योग्य जानकारी (PII): प्राथमिक विद्यालय की उम्र के बच्चों के नाम और फोन नंबर।
  • मेडिकल रिकॉर्ड: विस्तृत क्लिनिकल-ट्रायल डेटा और वास्तविक रोगी रिपोर्ट।
  • कॉर्पोरेट इंटेलिजेंस: "internal use only" चिह्नित दस्तावेज़, कर्मचारी प्रदर्शन समीक्षा, और अन्य मालिकाना जानकारी।
  • तकनीकी संपत्तियां: Claude के "Artifacts" फीचर के भीतर जेनरेट किए गए कोड स्निपेट्स, कार्य नोट्स और अन्य आर्टिफैक्ट्स।

कुछ मामलों में, सार्वजनिक रूप से दिखाई देने वाली चैट में ऐसी सामग्री भी शामिल थी जो Anthropic के सुरक्षा फिल्टरों से बच निकली और यौन रूप से स्पष्ट सामग्री उत्पन्न की।

Anthropic की प्रतिक्रिया

Anthropic maintains that it does not publish chat directories or sitemaps for search engines. A company spokesperson explained that shared links appear in search results only after a user posts the URL on an external, crawlable platform, and emphasized that the URLs are "not guessable." Once a link is deliberately shared online, the company cannot control third-party archiving.

Google’s Stance

Google reiterated that it does not decide what content is public; it indexes what it can find unless a site explicitly blocks crawling. The company said it respects directives such as robots.txt or meta tags that request exclusion. Preliminary tests after the incident suggest the exposed URLs have been removed from Google’s index, though Google did not confirm a permanent fix.

Why This Matters for AI Users

The episode highlights a broader risk as large language models move from personal assistants into enterprise workflows. A "shareable link" is a convenience mechanism that any crawler can harvest. For organizations handling regulated data—health records, employee evaluations, proprietary code—the assumption that a link is safe because it is "only shared" can lead to costly leaks.

Counter-Argument: Platform Limits

Anthropic argues that responsibility lies with users who publish the link. The platform warns that anyone with the URL can view the content and does not expose URLs in a public directory. Google counters that it cannot police every private link that surfaces; its role is to honor site owners’ requests to stay out of search results.

Both positions are technically accurate, yet they leave a gap: the user experience does not make the indexing risk obvious, and the platform does not automatically apply "no-index" directives to shared pages. The burden of preventing accidental public exposure therefore falls on users who may not realize how easily a link can be discovered through a simple search query.

What to Watch Next

Practical Steps for Users

  • Audit Active Links: Open Claude’s settings, navigate to the privacy section for shared chats, and revoke any URLs you no longer need.
  • Treat Every Share Link as Public: Assume that once a link is posted anywhere online, it can be indexed unless explicitly blocked.
  • Enterprise Controls: Deploy monitoring tools that flag the creation of share links containing keywords like "PII," "confidential," or "internal," and enforce approval workflows before such links leave the corporate network.

The Claude incident reminds us that the convenience of instant sharing can become a liability when the web treats those links as ordinary pages. Until platforms automatically protect shared URLs, users must remain vigilant.