Anthropic-ன் Claude-இல் ஒரு தனியுரிமை குறைபாடு (privacy vulnerability) கண்டறியப்பட்டது: தனிப்பட்ட உரையாடல்களும் "Artifacts"-களும் Google-இல் தேடக்கூடிய வகையில் இருந்தன. இந்தச் சம்பவம், AI யுகத்தில் பயனர்களால் பகிரப்படும் தகவல்களுக்கும் இணையத் தேடல் குறியீட்டு முறைக்கும் (web indexing) இடையிலான மோதலை வெளிச்சம் போட்டுக் காட்டுகிறது.
தகவல்கள் வெளிவராததற்கான வழிமுறை
Reddit பயனர்கள் site:claude.ai/share போன்ற Google ஆபரேட்டர்களைப் பயன்படுத்தி இந்தத் தரவு கசிவைக் கண்டறிந்தனர், இது "share chat" அம்சத்தின் intended privacy-யைத் தவிர்த்துவிட்டது. "இணைப்பு (link) வைத்திருப்பவர் யாராலும் இதைப் பார்க்க முடியும்" என்று Claude எச்சரிக்கிறது, ஆனால் இந்த அம்சம் குறிப்பிட்ட நபர்களுடன் பகிரப்படுவதற்காகவே உருவாக்கப்பட்டதே தவிர, உலகளாவிய அளவில் தெரியப்படுத்துவதற்காக அல்ல.
இயல்பாகவே (by default) க்ராலர்களைத் (crawlers) தடுக்கும் Google Docs போலல்லாமல், Claude-ன் பகிரப்பட்ட URL-கள் Google மூலம் குறியிடப்பட்டன (indexed), இதனால் சாதாரணத் தேடல்கள் மூலம் எவரும் முக்கியமான தகவல்களைக் கண்டறிய முடிந்தது.
ஆபத்தில் உள்ள முக்கியமான தரவுகள் மற்றும் உள்ளடக்கங்கள்
Futurism மற்றும் TechCrunch போன்ற ஊடகங்கள் அறிக்கையிட்டதின்படி, குறியிடப்பட்ட முடிவுகளில் பின்வருவன இருந்தன:
- தனிநபர் அடையாளம் காணக்கூடிய தகவல் (PII): ஆரம்பப் பள்ளி வயதுக் குழந்தைகளின் பெயர்கள் மற்றும் தொலைபேசி எண்கள்.
- மருத்துவக் குறிப்புகள்: விரிவான மருத்துவச் சோதனை முடிவுகள் மற்றும் உண்மையான நோயாளிகளின் அறிக்கைகள்.
- நிறுவனத் தகவல்கள்: "internal use only" எனக் குறிக்கப்பட்ட ஆவணங்கள் மற்றும் ஊழியர்களின் பணித்திறன் மதிப்பாய்வுகள்.
- தொழில்நுட்பச் சொத்துக்கள்: Claude-ன் "Artifacts" அம்சத்திலிருந்து பெறப்பட்ட குறியீட்டுத் துண்டுகள் (code snippets) மற்றும் பணி குறிப்புகள்.
வெளிப்பட்ட சில உரையாடல்கள் Anthropic-ன் பாதுகாப்பு வடிகட்டிகளைத் (safety filters) தாண்டிச் சென்றன, அவை பாலியல் ரீதியான வெளிப்படையான உள்ளடக்கங்களைக் காட்டியதுடன், மேலதிகக் கண்காணிப்பு (moderation) குறித்த கவலைகளையும் எழுப்பியது.
Anthropic மற்றும் Google-ன் பதில்கள்
Anthropic தனது கட்டமைப்பைப் பாதுகாத்துக் கொண்டு, தான் தேடுபொறிகளுடன் (search engines) உரையாடல் கோப்பகங்களையோ (chat directories) அல்லது சைட்மேப்களையோ (sitemaps) பகிர்ந்து கொள்வதில்லை என்று கூறியது. செய்தித் தொடர்பாளர் Amie Rotherham விளக்குகையில், பயனர்கள் வெளிப்புறத் தேடக்கூடிய தளங்களில் (crawlable platforms) பகிரும் போது மட்டுமே அந்தப் பகிரும் இணைப்புகள் (share links) தேடல் முடிவுகளில் தோன்றுகின்றன என்றும், அந்த URL-களை யாராலும் "ஊகிக்க முடியாது" (not guessable) என்றும் கூறினார். ஒரு இணைப்பு ஒருமுறை "பொதுவெளியில்" (out in the wild) பரவிவிட்டால், அது மூன்றாம் தரப்பினரால் சேமிக்கப்பட (archived) வாய்ப்புள்ளது.
தள உரிமையாளர்கள் க்ராலிங் செய்வதைத் (crawling) திட்டமிட்டுத் தடுக்காதவரை, தேடுபொறிகள் தாங்கள் கண்டறியும் எதையும் குறியீடு செய்யும் என்று Google செய்தித் தொடர்பாளர் Ned Adriance கூறினார். இந்தத் தகவல் வெளிப்பாடு தற்போது Google-ன் குறியீட்டிலிருந்து நீக்கப்பட்டுள்ளதாகச் சோதனைகள் தெரிவிக்கின்றன, இருப்பினும் கடந்த ஆண்டு நடந்த இதே போன்ற ஒரு சம்பவத்தில் நூற்றுக்கணக்கான Claude உரையாடல்கள் குறியிடப்பட்டன.
இது AI பயனர்களுக்கு ஏன் முக்கியமானது
LLM-களை ஒருங்கிணைக்கும் டெவலப்பர்கள் மற்றும் நிறுவனத் தலைவர்கள், "பகிரப்பட்ட இணைப்புகளை" (shared links) பாதுகாப்பானது என்று கருதாமல், பொதுவானவை என்றுதான் கருத வேண்டும். AI கருவிகள் தனிப்பட்ட உதவியாளர்களிலிருந்து நிறுவனக் கூட்டாளர்களாக மாறிவரும் நிலையில், பொது இணைய உள்ளடக்கத்திற்கும் தனிப்பட்ட தரவுக்கும் இடையிலான எல்லையை வெறும் tooltip எச்சரிக்கை மூலம் மட்டும் அல்லாமல், தொழில்நுட்ப ரீதியாக உறுதிப்படுத்த வேண்டியது அவசியம்.
முக்கியக் குறிப்புகள்
- உங்கள் அமைப்புகளைச் சரிபார்க்கவும் (Audit Your Settings): Claude-இல் Settings → Privacy → Shared Chats என்பதற்குச் சென்று, தற்போது செயல்பாட்டில் உள்ள பொது இணைப்புகளைத் (public links) திரும்பப் பெறவும்.
- பகிரப்பட்ட இணைப்புகளைப் பொதுவானவை எனக் கருதவும்: AI மூலம் உருவாக்கப்படும் எந்தவொரு இணைப்பும் தேடுபொறிகளால் குறியிடப்படலாம் என்று கருதுங்கள்.
- நிறுவனக் கவனம் (Enterprise Caution): நிறுவனத்தின் ரகசியக் குறியீடுகள் (proprietary code) அல்லது முக்கியமான PII தரவுகள் தற்செயலாக கசிவதைத் தடுக்க, "பகிர்வு" (share) அம்சங்கள் குறித்த கடுமையான கொள்கைகளை அமல்படுத்துங்கள்.
Anthropic-ன் Claude AI தளம், அதன் share-link URL-களை Google குறியீடு செய்ததன் மூலம், தவறுதலாகத் தனிப்பட்ட உரையாடல்களையும் “Artifacts”-களையும் வெளிப்படுத்தியது, இதனால் முக்கியமான உரையாடல்களைத் தேட முடிந்தது. Reddit பயனர்கள் ஒரு குறிப்பிட்ட தளத்திற்கான Google தேடல் மூலம் இந்தத் தரவு கசிவைக் கண்டறிந்தனர், இது தனிப்பட்ட, மருத்துவ மற்றும் நிறுவனத் தரவுகளை வெளிப்படுத்தியது.
தகவல் எவ்வாறு வெளிப்பட்டது
Claude-ன் "share chat" அம்சம் ஒரு URL-ஐ உருவாக்குகிறது, அதை வைத்திருப்பவர் யாராலும் இதைப் பார்க்க முடியும் என்று அந்த இடைமுகம் (interface) எச்சரிக்கிறது. இதன் நோக்கம் ஒரு சக ஊழியரிடம் இணைப்பைப் பகிர்வதே தவிர, அதை உலகிற்குப் பரப்புவதல்ல. இந்த URL-கள் claude.ai/share டொமைனுக்குக் கீழ் இருப்பதால், எந்தவொரு பொதுவான தேடக்கூடிய தளத்திலும்—மன்றங்கள், சமூக ஊடகங்கள் அல்லது ஒரு Reddit கருத்து—இணைப்பைப் பதிவிடுவதன் மூலம், Google-ன் க்ராலரால் (crawler) அதைத் தொடர முடியும்.
Reddit பயனர்கள் Google-இல் site:claude.ai/share என்று தேடுவதன் மூலம் இந்தச் சிக்கலைக் கண்டறிந்தனர், இது தனிப்பட்ட முறையில் இருக்க வேண்டிய உரையாடல்களைத் திரட்டியது. இயல்பாகவே குறியீட்டிலிருந்து (indexing) பாதுகாக்கப்படும் Google Docs-ன் பகிரப்பட்ட இணைப்புகளைப் போலல்லாமல், Claude-ன் இணைப்புகளில் அத்தகைய பாதுகாப்பு இல்லை, இது தேடுபொறி அவற்றை வகைப்படுத்த (catalog) அனுமதித்தது.
என்ன வெளிப்பட்டது
பல ஊடகங்கள் அறிக்கையிட்டதின்படி, குறியிடப்பட்ட முடிவுகளில் பின்வருவன இருந்தன:
- தனிநபர் அடையாளம் காணக்கூடிய தகவல் (PII): ஆரம்பப் பள்ளி வயதுக் குழந்தைகளின் பெயர்கள் மற்றும் தொலைபேசி எண்கள்.
- மருத்துவக் குறிப்புகள்: விரிவான மருத்துவச் சோதனைத் தரவுகள் மற்றும் உண்மையான நோயாளிகளின் அறிக்கைகள்.
- நிறுவனத் தகவல்கள்: "internal use only" எனக் குறிக்கப்பட்ட ஆவணங்கள், ஊழியர்களின் பணித்திறன் மதிப்பாய்வுகள் மற்றும் பிற நிறுவனத் தகவல்கள்.
- தொழில்நுட்பச் சொத்துக்கள்: Claude-ன் "Artifacts" அம்சத்திற்குள் உருவாக்கப்பட்ட குறியீட்டுத் துண்டுகள், பணி குறிப்புகள் மற்றும் பிற artifacts.
சில சந்தர்ப்பங்களில், பொதுவெளியில் தெரிந்த உரையாடல்களில் Anthropic-ன் பாதுகாப்பு வடிகட்டிகளைத் தாண்டிச் சென்ற பாலியல் ரீதியான வெளிப்படையான உள்ளடக்கங்களும் இருந்தன.
Anthropic-ன் பதில்
Anthropic தான் தேடு பொறிகளுக்காக (search engines) உரையாடல் கோப்பகங்களையோ (chat directories) அல்லது தள வரைபடங்களையோ (sitemaps) வெளியிடுவதில்லை என்று கூறுகிறது. பகிரப்பட்ட இணைப்புகள் ஒரு பயனர் அவற்றை ஒரு வெளிப்புற, க்ரால் செய்யக்கூடிய (crawlable) தளத்தில் பதிவிட்ட பிறகு மட்டுமே தேடல் முடிவுகளில் தோன்றுகின்றன என்று நிறுவனத்தின் செய்தித் தொடர்பாளர் விளக்கினார், மேலும் அந்த URL-களை "கணிப்பதே முடியாது" (not guessable) என்றும் வலியுறுத்தினார். ஒரு இணைப்பு இணையத்தில் வேண்டுமென்றே பகிரப்பட்டவுடன், மூன்றாம் தரப்பு ஆவணப்படுத்துதலை (third-party archiving) நிறுவனத்தால் கட்டுப்படுத்த முடியாது.
Google-ன் நிலைப்பாடு
எந்தக் உள்ளடக்கம் பொதுவானது என்பதைத் தான் தீர்மானிப்பதில்லை என்று Google மீண்டும் உறுதிப்படுத்தியது; ஒரு தளம் க்ராலிங் செய்வதைத் (crawling) தெளிவாகத் தடுக்காத வரை, தான் கண்டறியக்கூடியவற்றைத் தான் இன்டெக்ஸ் (index) செய்கிறது என்று கூறியது. விலக்கத்தைக் கோரும் robots.txt அல்லது meta tags போன்ற வழிகாட்டுதல்களைத் தான் மதிக்கிறோம் என்று நிறுவனம் கூறியது. இந்தச் சம்பவத்திற்குப் பிறகு நடத்தப்பட்ட ஆரம்பகட்ட சோதனைகள், வெளிப்படையான URL-கள் Google-ன் இன்டெக்ஸிலிருந்து நீக்கப்பட்டுள்ளதை உணர்த்துகின்றன, இருப்பினும் நிரந்தரத் தீர்வை Google உறுதிப்படுத்தவில்லை.
இது AI பயனர்களுக்கு ஏன் முக்கியமானது
பெரிய மொழி மாதிரிகள் (large language models) தனிப்பட்ட உதவியாளர்களிலிருந்து நிறுவனப் பணிப்பாய்வுகளுக்கு (enterprise workflows) மாறும்போது, இந்தச் சம்பவம் ஒரு பரந்த அபாயத்தை எடுத்துக்காட்டுகிறது. "பகிரக்கூடிய இணைப்பு" (shareable link) என்பது எந்தவொரு க்ராலரும் (crawler) சேகரிக்கக்கூடிய ஒரு வசதி வழிமுறையாகும். ஒழுங்குபடுத்தப்பட்ட தரவுகளைக் கையாளும் நிறுவனங்களுக்கு—மருத்துவப் பதிவுகள், ஊழியர் மதிப்பீடுகள், சொத்துரிமை கொண்ட குறியீடுகள் (proprietary code)—ஒரு இணைப்பு "பகிரப்பட்டது மட்டுமே" என்பதால் அது பாதுகாப்பானது என்ற அனுமானம், பெரும் இழப்பை ஏற்படுத்தும் கசிவுகளுக்கு வழிவகுக்கும்.
எதிர் வாதம்: தளத்தின் வரம்புகள்
இணைப்பை வெளியிடும் பயனர்களிடமே பொறுப்பு உள்ளது என்று Anthropic வாதிடுகிறது. URL வைத்திருப்பவர் யாராக இருந்தாலும் உள்ளடக்கத்தைப் பார்க்க முடியும் என்றும், பொதுவான கோப்பகத்தில் URL-களைத் தான் வெளிப்படுத்துவதில்லை என்றும் அந்தத் தளம் எச்சரிக்கிறது. வெளிப்படும் ஒவ்வொரு தனிப்பட்ட இணைப்பையும் கண்காணிக்க முடியாது என்றும்; தேடல் முடிவுகளில் வராமல் இருக்கத் தள உரிமையாளர்களின் கோரிக்கைகளை மதிப்பதே தனது பணி என்றும் Google பதிலளிக்கிறது.
இரண்டு நிலைகளும் தொழில்நுட்ப ரீதியாகத் துல்லியமானவை, இருப்பினும் அவை ஒரு இடைவெளியை விட்டுச் செல்கின்றன: பயனர் அனுபவம் (user experience) இன்டெக்ஸ் செய்வதால் ஏற்படும் அபாயத்தை வெளிப்படையாகக் காட்டுவதில்லை, மேலும் பகிரப்பட்ட பக்கங்களுக்குத் தளம் தானாகவே "no-index" வழிகாட்டுதல்களைப் பயன்படுத்துவதில்லை. எனவே, ஒரு சாதாரணத் தேடல் மூலம் ஒரு இணைப்பு எவ்வளவு எளிதாகக் கண்டறியப்படலாம் என்பதை உணரத் தெரியாத பயனர்களிடமே, தற்செயலான பொது வெளிப்பாட்டைத் தடுக்கும் பொறுப்பு உள்ளது.
அடுத்து கவனிக்க வேண்டியவை
பயனர்களுக்கான நடைமுறைப் படிகள்
- செயலில் உள்ள இணைப்புகளைச் சரிபார்க்கவும் (Audit Active Links): Claude-ன் அமைப்புகளைத் (settings) திறந்து, பகிரப்பட்ட உரையாடல்களுக்கான தனியுரிமைப் பகுதிக்குச் சென்று, உங்களுக்குத் தேவையில்லாத எந்தவொரு URL-களையும் ரத்து செய்யவும்.
- ஒவ்வொரு பகிரும் இணைப்பையும் பொதுவானதாகக் கருதவும்: ஒரு இணைப்பு இணையத்தில் எங்காவது பதிவிடப்பட்டால், அது தெளிவாகத் தடுக்கப்படாத வரை இன்டெக்ஸ் செய்யப்படலாம் என்று கருதுங்கள்.
- நிறுவனக் கட்டுப்பாடுகள் (Enterprise Controls): "PII," "confidential," அல்லது "internal" போன்ற முக்கியச் சொற்களைக் கொண்ட பகிரும் இணைப்புகள் உருவாக்கப்படுவதைக் கண்டறியும் கண்காணிப்புக் கருவிகளைப் பயன்படுத்தவும், மேலும் அத்தகைய இணைப்புகள் நிறுவன நெட்வொர்க்கை விட்டு வெளியேறுவதற்கு முன் ஒப்புதல் பணிப்பாய்வுகளை (approval workflows) நடைமுறைப்படுத்தவும்.
இணையம் அந்த இணைப்புகளை சாதாரணப் பக்கங்களாகக் கருதும் போது, உடனடிப் பகிர்வின் வசதி ஒரு அபாயமாக மாறக்கூடும் என்பதை Claude சம்பவம் நமக்கு நினைவூட்டுகிறது. தளங்கள் பகிரப்பட்ட URL-களைத் தானாகவே பாதுகாக்கும் வரை, பயனர்கள் விழிப்புடன் இருக்க வேண்டும்.
