Anthropic-ന്റെ Claude-ൽ ഒരു സ്വകാര്യതാ സുരക്ഷാ വീഴ്ച (privacy vulnerability) കണ്ടെത്തി: സ്വകാര്യ സംഭാഷണങ്ങളും "Artifacts"-ഉം Google-ൽ തിരയാൻ സാധിക്കുന്ന രീതിയിൽ ലഭ്യമായി. AI യുഗത്തിൽ ഉപയോക്താക്കളുടെ പങ്കുവെക്കൽ രീതികളും വെബ് ഇൻഡക്സിംഗും തമ്മിലുള്ള സംഘർഷമാണ് ഈ സംഭവം വെളിപ്പെടുത്തുന്നത്.
വിവരങ്ങൾ പുറത്തായതിന്റെ രീതി
site:claude.ai/share പോലുള്ള Google ഓപ്പറേറ്ററുകൾ ഉപയോഗിച്ചാണ് Reddit ഉപയോക്താക്കൾ ഈ സുരക്ഷാ വീഴ്ച കണ്ടെത്തിയത്. ഇത് "share chat" ഫീച്ചറിന്റെ ഉദ്ദേശ്യമായ സ്വകാര്യതയെ മറികടന്നു. "ലിങ്ക് ഉള്ള ആർക്കും ഇത് കാണാൻ കഴിയും" എന്ന് Claude മുന്നറിയിപ്പ് നൽകുന്നുണ്ടെങ്കിലും, ഈ ഫീച്ചർ ഉദ്ദേശിക്കുന്നത് പ്രത്യേക വ്യക്തികളുമായി പങ്കുവെക്കാനാണ്, ലോകമെമ്പാടും ലഭ്യമാക്കാനല്ല.
ഡിഫോൾട്ട് ആയി ക്രോളറുകളെ (crawlers) തടയുന്ന Google Docs-ൽ നിന്ന് വ്യത്യസ്തമായി, Claude-ന്റെ ഷെയർ ചെയ്ത URL-കൾ Google ഇൻഡക്സ് ചെയ്തു. ഇത് സാധാരണ സെർച്ചിലൂടെ ആർക്കും സെൻസിറ്റീവ് ആയ വിവരങ്ങൾ കണ്ടെത്താൻ ഇടയാക്കി.
അപകടത്തിലായ സെൻസിറ്റീവ് വിവരങ്ങളും ഉള്ളടക്കവും
ഇൻഡക്സ് ചെയ്ത ഫലങ്ങളിൽ താഴെ പറയുന്നവ അടങ്ങിയിട്ടുണ്ടെന്ന് Futurism, TechCrunch തുടങ്ങിയ മാധ്യമങ്ങൾ റിപ്പോർട്ട് ചെയ്തു:
- വ്യക്തിഗത തിരിച്ചറിയൽ വിവരങ്ങൾ (PII): പ്രൈമറി സ്കൂൾ പ്രായത്തിലുള്ള കുട്ടികളുടെ പേരുകളും ഫോൺ നമ്പറുകളും.
- മെഡിക്കൽ റെക്കോർഡുകൾ: വിശദമായ ക്ലിനിക്കൽ ട്രയൽ ഫലങ്ങളും യഥാർത്ഥ രോഗികളുടെ റിപ്പോർട്ടുകളും.
- കോർപ്പറേറ്റ് വിവരങ്ങൾ: "internal use only" എന്ന് അടയാളപ്പെടുത്തിയ രേഖകളും ജീവനക്കാരുടെ പെർഫോമൻസ് റിവ്യൂകളും.
- സാങ്കേതിക ആസ്തികൾ: Claude-ന്റെ "Artifacts" ഫീച്ചറിൽ നിന്നുള്ള കോഡ് സ്നിപ്പറ്റുകളും (code snippets) വർക്ക് നോട്ടുകളും.
പുറത്തായ ചില ചാറ്റുകൾ Anthropic-ന്റെ സേഫ്റ്റി ഫിൽട്ടറുകളെ മറികടന്നതായും, ലൈംഗികമായി വ്യക്തമായ (sexually explicit) ഉള്ളടക്കം കാണിച്ചതായും റിപ്പോർട്ട് ചെയ്യപ്പെട്ടിട്ടുണ്ട്. ഇത് മോഡറേഷൻ സംബന്ധമായ കൂടുതൽ ആശങ്കകൾ ഉയർത്തുന്നു.
Anthropic-ഉം Google-ഉം നൽകുന്ന മറുപടി
തങ്ങൾ ചാറ്റ് ഡയറക്ടറികളോ സൈറ്റ്മാപ്പുകളോ (sitemaps) സെർച്ച് എഞ്ചിനുകളുമായി പങ്കുവെക്കുന്നില്ലെന്ന് പറഞ്ഞുകൊണ്ട് Anthropic തങ്ങളുടെ ആർക്കിടെക്ചറിനെ ന്യായീകരിച്ചു. ഉപയോക്താക്കൾ ഷെയർ ലിങ്കുകൾ പുറത്തുള്ള ക്രോൾ ചെയ്യാവുന്ന പ്ലാറ്റ്ഫോമുകളിൽ പോസ്റ്റ് ചെയ്തതിന് ശേഷം മാത്രമേ അവ സെർച്ച് റിസൾട്ടുകളിൽ കാണപ്പെടുന്നുള്ളൂ എന്നും, ഈ URL-കൾ "ഊഹിച്ചെടുക്കാൻ കഴിയില്ലെന്നും" വക്താവ് Amie Rotherham വിശദീകരിച്ചു. ഒരിക്കൽ ഒരു ലിങ്ക് "പൊതുവായി ലഭ്യമായാൽ" (out in the wild), അത് മൂന്നാം കക്ഷികൾക്ക് ആർക്കൈവ് ചെയ്യാൻ സാധിക്കും.
സൈറ്റ് ഉടമകൾ ക്രോളിംഗ് വ്യക്തമായി തടയുന്നില്ലെങ്കിൽ സെർച്ച് എഞ്ചിനുകൾ തങ്ങൾക്ക് കണ്ടെത്താൻ കഴിയുന്നതെല്ലാം ഇൻഡക്സ് ചെയ്യുമെന്ന ഗൂഗിൾ വക്താവ് Ned Adriance-ന്റെ വാക്കുകളും സമാനമാണ്. ഈ വിവരങ്ങൾ ഇപ്പോൾ ഗൂഗിൾ ഇൻഡക്സിൽ നിന്ന് നീക്കം ചെയ്തതായി പരിശോധനകൾ സൂചിപ്പിക്കുന്നുണ്ടെങ്കിലും, കഴിഞ്ഞ വർഷവും സമാനമായ ഒരു സംഭവം വഴി നൂറുകണക്കിന് Claude ചാറ്റുകൾ ഇൻഡക്സ് ചെയ്യപ്പെട്ടിരുന്നു.
എന്തുകൊണ്ടാണ് ഇത് AI ഉപയോക്താക്കൾക്ക് പ്രധാനമാകുന്നത്
LLM-കൾ ഉപയോഗപ്പെടുത്തുന്ന ഡെവലപ്പർമാരും സ്ഥാപകരും "shared links"-നെ സുരക്ഷിതമെന്ന് കരുതുന്നതിന് പകരം പൊതുവായ ഒന്നായി കാണണം. AI ടൂളുകൾ വ്യക്തിഗത സഹായികളിൽ നിന്ന് എന്റർപ്രൈസ് സഹകാരികളായി മാറുന്നതനുസരിച്ച്, പൊതുവായ വെബ് ഉള്ളടക്കവും സ്വകാര്യ വിവരങ്ങളും തമ്മിലുള്ള വ്യത്യാസം വെറുമൊരു ടൂൾ ടിപ്പ് മുന്നറിയിപ്പിലൂടെയല്ല, മറിച്ച് സാങ്കേതികമായ കർശനമായ നിയന്ത്രണങ്ങളിലൂടെയാണ് ഉറപ്പാക്കേണ്ടത്.
പ്രധാന കാര്യങ്ങൾ
- നിങ്ങളുടെ സെറ്റിംഗ്സ് പരിശോധിക്കുക: Claude-ൽ Settings → Privacy → Shared Chats എന്ന ഭാഗത്തേക്ക് പോയി നിലവിലുള്ള ഏതെങ്കിലും പബ്ലിക് ലിങ്കുകൾ റദ്ദാക്കുക.
- ഷെയർ ലിങ്കുകളെ പൊതുവായവയായി കാണുക: AI നിർമ്മിക്കുന്ന ഏതൊരു ലിങ്കും സെർച്ച് എഞ്ചിനുകൾ ഇൻഡക്സ് ചെയ്തേക്കാം എന്ന് കരുതുക.
- സ്ഥാപനങ്ങളിൽ ജാഗ്രത പാലിക്കുക: ഉടമസ്ഥാവകാശമുള്ള കോഡുകളോ സെൻസിറ്റീവ് ആയ PII വിവരങ്ങളോ അബദ്ധത്തിൽ പുറത്തായില്ലെന്ന് ഉറപ്പാക്കാൻ "share" ഫീച്ചറുകളിൽ കർശനമായ നയങ്ങൾ നടപ്പിലാക്കുക.
Anthropic-ന്റെ Claude AI പ്ലാറ്റ്ഫോമിലെ ഷെയർ-ലിങ്ക് URL-കൾ Google ഇൻഡക്സ് ചെയ്തതോടെ, സ്വകാര്യ ചാറ്റുകളും “Artifacts”-ഉം അബദ്ധത്തിൽ പുറത്താവുകയും സെൻസിറ്റീവ് ആയ സംഭാഷണങ്ങൾ സെർച്ച് ചെയ്യാൻ സാധിക്കുന്നതാവുകയും ചെയ്തു. ഒരു സൈറ്റ്-സ്പെസിഫിക് ഗൂഗിൾ ക്വറിയിലൂടെ Reddit ഉപയോക്താക്കളാണ് ഈ ചോർച്ച കണ്ടെത്തിയത്, ഇത് വ്യക്തിഗതവും മെഡിക്കൽ, കോർപ്പറേറ്റ് വിവരങ്ങളും വെളിപ്പെടുത്തി.
വിവരങ്ങൾ എങ്ങനെ പുറത്തായി
Claude-ന്റെ "share chat" ഫീച്ചർ ഒരു URL നിർമ്മിക്കുന്നു, അത് കൈവശമുള്ള ആർക്കും കാണാൻ കഴിയുമെന്ന് ഇന്റർഫേസ് മുന്നറിയിപ്പ് നൽകുന്നുണ്ട്. ഈ ലിങ്ക് ഒരു സഹപ്രവർത്തകന് നൽകാനാണ് ഉദ്ദേശിക്കുന്നത്, പരസ്യമായി പ്രചരിപ്പിക്കാനല്ല. ഈ URL-കൾ claude.ai/share എന്ന ഡൊമൈനിന് കീഴിലുള്ളതുകൊണ്ട്, ഫോറങ്ങൾ, സോഷ്യൽ മീഡിയ അല്ലെങ്കിൽ ഒരു Reddit കമന്റ് എന്നിങ്ങനെ പൊതുവായി ക്രോൾ ചെയ്യാവുന്ന ഏതൊരു സൈറ്റിലും ഈ ലിങ്ക് പോസ്റ്റ് ചെയ്താൽ ഗൂഗിളിന്റെ ക്രോളറിന് അത് പിന്തുടരാൻ സാധിക്കും.
ഗൂഗിളിൽ site:claude.ai/share എന്ന് തിരഞ്ഞതിലൂടെയാണ് Reddit ഉപയോക്താക്കൾ ഈ പ്രശ്നം കണ്ടെത്തിയത്, ഇത് സ്വകാര്യമായിരിക്കേണ്ട സംഭാഷണങ്ങൾ കാണിച്ചുതന്നു. ഡിഫോൾട്ട് ആയി ഇൻഡക്സിംഗിൽ നിന്ന് സംരക്ഷിക്കപ്പെട്ടിട്ടുള്ള Google Docs-ൽ നിന്ന് വ്യത്യസ്തമായി, Claude-ന്റെ ലിങ്കുകളിൽ അത്തരം സുരക്ഷാ സംവിധാനങ്ങൾ ഇല്ലാതിരുന്നതിനാൽ സെർച്ച് എഞ്ചിന് അവ രേഖപ്പെടുത്താൻ (catalog) കഴിഞ്ഞു.
എന്തൊക്കെയാണ് പുറത്തായത്
ഇൻഡക്സ് ചെയ്ത ഫലങ്ങളിൽ താഴെ പറയുന്നവ അടങ്ങിയിട്ടുണ്ടെന്ന് വിവിധ മാധ്യമങ്ങൾ റിപ്പോർട്ട് ചെയ്തു:
- വ്യക്തിഗത തിരിച്ചറിയൽ വിവരങ്ങൾ (PII): പ്രൈമറി സ്കൂൾ പ്രായത്തിലുള്ള കുട്ടികളുടെ പേരുകളും ഫോൺ നമ്പറുകളും.
- മെഡിക്കൽ റെക്കോർഡുകൾ: വിശദമായ ക്ലിനിക്കൽ ട്രയൽ ഡാറ്റയും യഥാർത്ഥ രോഗികളുടെ റിപ്പോർട്ടുകളും.
- കോർപ്പറേറ്റ് വിവരങ്ങൾ: "internal use only" എന്ന് അടയാളപ്പെടുത്തിയ രേഖകൾ, ജീവനക്കാരുടെ പെർഫോമൻസ് റിവ്യൂകൾ, മറ്റ് ഉടമസ്ഥാവകാശമുള്ള വിവരങ്ങൾ എന്നിവ.
- സാങ്കേതിക ആസ്തികൾ: Claude-ന്റെ "Artifacts" ഫീച്ചറിൽ നിർമ്മിച്ച കോഡ് സ്നിപ്പറ്റുകൾ, വർക്ക് നോട്ടുകൾ, മറ്റ് ആർട്ടിഫാക്റ്റുകൾ എന്നിവ.
ചില സന്ദർഭങ്ങളിൽ, പരസ്യമായി കാണാവുന്ന ചാറ്റുകളിൽ Anthropic-ന്റെ സേഫ്റ്റി ഫിൽട്ടറുകളെ മറികടന്ന ലൈംഗികമായി വ്യക്തമായ (sexually explicit) ഉള്ളടക്കങ്ങളും ഉൾപ്പെട്ടിരുന്നു.
Anthropic-ന്റെ മറുപടി
Anthropic maintains that it does not publish chat directories or sitemaps for search engines. A company spokesperson explained that shared links appear in search results only after a user posts the URL on an external, crawlable platform, and emphasized that the URLs are "not guessable." Once a link is deliberately shared online, the company cannot control third-party archiving.
Google’s Stance
Google reiterated that it does not decide what content is public; it indexes what it can find unless a site explicitly blocks crawling. The company said it respects directives such as robots.txt or meta tags that request exclusion. Preliminary tests after the incident suggest the exposed URLs have been removed from Google’s index, though Google did not confirm a permanent fix.
Why This Matters for AI Users
The episode highlights a broader risk as large language models move from personal assistants into enterprise workflows. A "shareable link" is a convenience mechanism that any crawler can harvest. For organizations handling regulated data—health records, employee evaluations, proprietary code—the assumption that a link is safe because it is "only shared" can lead to costly leaks.
Counter-Argument: Platform Limits
Anthropic argues that responsibility lies with users who publish the link. The platform warns that anyone with the URL can view the content and does not expose URLs in a public directory. Google counters that it cannot police every private link that surfaces; its role is to honor site owners’ requests to stay out of search results.
Both positions are technically accurate, yet they leave a gap: the user experience does not make the indexing risk obvious, and the platform does not automatically apply "no-index" directives to shared pages. The burden of preventing accidental public exposure therefore falls on users who may not realize how easily a link can be discovered through a simple search query.
What to Watch Next
Practical Steps for Users
- Audit Active Links: Open Claude’s settings, navigate to the privacy section for shared chats, and revoke any URLs you no longer need.
- Treat Every Share Link as Public: Assume that once a link is posted anywhere online, it can be indexed unless explicitly blocked.
- Enterprise Controls: Deploy monitoring tools that flag the creation of share links containing keywords like "PII," "confidential," or "internal," and enforce approval workflows before such links leave the corporate network.
The Claude incident reminds us that the convenience of instant sharing can become a liability when the web treats those links as ordinary pages. Until platforms automatically protect shared URLs, users must remain vigilant.
