Google ने खेल के नियम बदल दिए हैं। अगर आपने पिछले हफ्ते Google Lens के माध्यम से कोई फोटो खींची थी, Google Translate में किसी स्पेनिश वाक्यांश का ज़ोर से अभ्यास किया था, या Maps से लंच की जगह ढूँढने को कहा था, तो वह कंटेंट अब कंपनी के जनरेटिव AI मॉडल्स को ट्रेन करने के लिए एक कतार में हो सकता है। Google ने हाल ही में अपने प्राइवेसी आर्किटेक्चर को पुनर्गठित किया है ताकि इसके इकोसिस्टम में यूजर्स द्वारा अपलोड किए गए इमेज, ऑडियो क्लिप और वीडियो को सुरक्षित रखा जा सके और मशीन लर्निंग सिस्टम बनाने के लिए उपयोग किया जा सके। यह सार्वजनिक वेब पेजों को स्क्रैप करने के बजाय, लोगों द्वारा हर दिन Google प्रोडक्ट्स के साथ किए जाने वाले सीधे और उच्च-इरादे (high-intent) वाले इंटरैक्शन को इकट्ठा करने की दिशा में एक सोची-समझी रणनीति है।

शांत नीति परिवर्तन

यह सेवा की शर्तों (terms-of-service) का कोई नियमित अपडेट नहीं है। वर्षों से, बड़े AI मॉडल्स को ट्रेन करने का मानक तरीका अरबों सार्वजनिक वेब पेजों को क्रॉल करना, टेक्स्ट, इमेज और लिंक इकट्ठा करना था जो पहले से ही दुनिया के लिए उपलब्ध थे। उस दृष्टिकोण की सीमाएं हैं। ओपन वेब सीमित है, और कई क्षेत्रों में सबसे मूल्यवान सार्वजनिक डेटा पहले ही निकाला जा चुका है और मौजूदा सिस्टम में डाल दिया गया है। Meta जैसे प्रतिस्पर्धियों ने हाल ही में यूजर-जनरेटेड कंटेंट का उपयोग करने की ओर कदम बढ़ाए हैं, और Google अब उसी दिशा में बढ़ रहा है।

यह अपडेट ग्राहकों को एक ईमेल के माध्यम से मिला, जिसमें दो नए प्राइवेसी कंट्रोल पेश किए गए: Search Services History और Personalized Recommendations। ऊपर से देखने पर, ये मानक पर्सनलाइजेशन टूल्स की तरह लगते हैं जिनका उद्देश्य आपकी अगली क्वेरी को तेज़ करना या आपके सुझावों को बेहतर बनाना है। हालांकि, बारीक अक्षरों (fine print) को पढ़ने पर इसका दायरा स्पष्ट हो जाता है। Google का कहना है कि सेव किए गए मीडिया का उपयोग "Google सेवाओं और तकनीकों को विकसित करने और सुधारने के लिए किया जा सकता है, जिसमें AI मॉडल और सुरक्षा उपाय शामिल हैं।" शब्दों का चयन व्यापक है, डिफॉल्ट सेटिंग 'ऑन' है, और इससे बाहर निकलने (opting out) के लिए आपको यह जानना होगा कि कहाँ देखना है।

Google वास्तव में आपसे क्या चाहता है

डेटा कलेक्शन का यह दायरा आपके द्वारा उपयोग की जाने वाली लगभग हर प्रमुख Google सेवा को कवर करता है। जब कोई पर्यटक किसी विदेशी स्ट्रीट साइन या डिनर मेनू पर Google Lens का उपयोग करता है, तो परिणाम आने के बाद विजुअल इनपुट बस गायब नहीं हो जाता है। जब कोई छात्र बोलकर अभ्यास करने के लिए Google Translate का उपयोग करता है, तो उन सत्रों के दौरान रिकॉर्ड किए गए ऑडियो को सुरक्षित रखने के लिए पात्र माना जाता है। Search Live या स्टैंडर्ड वॉइस सर्च के माध्यम से भेजी गई वॉयस क्वेरी भी इसी नीति के अंतर्गत आती हैं। यहाँ तक कि Maps, Shopping, Flights, Hotels और News के साथ नियमित इंटरैक्शन भी ऐसा मीडिया जेनरेट कर सकते हैं जिसे Google अब ट्रेनिंग मटेरियल के रूप में वर्गीकृत करता है।

पहले, जो यूजर्स प्राइवेसी को लेकर गंभीर थे, वे Google द्वारा इस इंटरैक्शन डेटा को रखने की सीमा तय करने के लिए Web & App Activity स्विच का सहारा ले सकते थे। वह रणनीति अब काम नहीं करती है। Google ने स्पष्ट रूप से इन नई सेटिंग्स को Web & App Activity से अलग कर दिया है। Search Services History एक स्वतंत्र कंट्रोल है। यह डिफॉल्ट रूप से ऑन रहता है, और दो या तीन साल पहले आपके प्राइवेसी डैशबोर्ड में किए गए चुनाव आपके सर्च-संबंधित मीडिया को AI ट्रेनिंग के लिए स्टोर होने से नहीं रोक पाएंगे। पुराना 'ऑफ' स्विच अब इस विशेष सर्किट को नियंत्रित नहीं करता है।

वास्तव में ऑप्ट आउट कैसे करें

Google मैन्युअल ओवरराइड का विकल्प तो देता है, लेकिन इसकी पूरी जिम्मेदारी आप पर है। ऐसा कोई अकाउंट-वाइड टॉगल नहीं है जो एक क्लिक में AI ट्रेनिंग डेटा कलेक्शन को अक्षम (disable) कर दे। आपको अपने Google अकाउंट डैशबोर्ड के भीतर दो विशिष्ट पेजों पर जाना होगा: Search Services History पेज और Search Services Personalization पेज।

एक बार जब आप Search Services History में पहुँच जाएँ, तो तब तक स्क्रॉल करें जब तक आपको "Save Media" चेकबॉक्स न मिल जाए। इसे अनचेक कर दें। यही एक अकेला कदम भविष्य के इमेज, ऑडियो और वीडियो को स्टोर होने और संभावित रूप से मॉडल ट्रेनिंग में इस्तेमाल होने से रोकता है। यह न समझें कि Web & App Activity को अक्षम करने से यह काम हो जाएगा। ऐसा नहीं होगा। इन सेटिंग्स का अलग होना स्पष्ट है लेकिन इसे मिस करना आसान है, जिसका अर्थ है कि कई यूजर्स को लगेगा कि उन्होंने ऑप्ट आउट कर लिया है, जबकि उन्होंने नहीं किया होगा।

मीडिया सेविंग को अक्षम करने के बाद, उसी डैशबोर्ड में रहते हुए अपनी ऑटो-डिलीट प्राथमिकताओं (preferences) को कॉन्फ़िगर करें। Google तीन विकल्प देता है: 3 महीने, 18 महीने या 36 महीने के बाद डेटा डिलीट करें। यदि आप सबसे कड़ा नियंत्रण चाहते हैं, तो तीन महीने की अवधि चुनें। यह इस कंट्रोल के माध्यम से Google द्वारा दी जाने वाली सबसे छोटी क्लीनअप साइकिल है, और यह आपके पुराने इंटरैक्शन के बैकलॉग को सीमित करती है। ध्यान रखें कि 'Save Media' को बंद करने से भविष्य का कलेक्शन रुक जाता है। पिछली सेटिंग्स के तहत Google ने जो कुछ भी पहले से लॉग किया है, वह स्टोरेज में बना रह सकता है जब तक कि आप उन्हीं अकाउंट टूल्स के माध्यम से अपनी मौजूदा हिस्ट्री को मैन्युअल रूप से डिलीट न कर दें।

यदि आप एक साझा फैमिली अकाउंट या ऐसे वर्कस्पेस का प्रबंधन करते हैं जहाँ कई लोग Google सेवाओं का उपयोग करते हैं, तो एक्सेस रखने वाले प्रत्येक व्यक्ति को व्यक्तिगत रूप से इन सेटिंग्स की जाँच करनी चाहिए। पर्सनलाइजेशन कंट्रोल अकाउंट से जुड़े होते हैं, डिवाइस से नहीं, और डिफ़ॉल्ट ऑप्ट-इन सभी पर समान रूप से लागू होता है।

यह हमें AI के अगले चरण के बारे में क्या बताता है

यह पॉलिसी बदलाव इस बात का स्पष्ट संकेत है कि इंडस्ट्री किस दिशा में बढ़ रही है। ट्रेनिंग मटेरियल के लिए पब्लिक वेब का पूरी तरह से उपयोग किया जा चुका है। लार्ज लैंग्वेज मॉडल्स और मल्टीमॉडल सिस्टम को बेहतर बनाने के लिए अगला मोर्चा क्लोज्ड प्लेटफॉर्म्स के भीतर वास्तविक लोगों द्वारा जेनरेट किया गया प्रोप्रायटरी डेटा है। आपके विजुअल सर्च में स्थानिक संदर्भ (spatial context) होता है। आपके ट्रांसलेशन प्रैक्टिस सेशन में उच्चारण के पैटर्न और बातचीत का इरादा (conversational intent) होता है। आपकी वॉयस क्वेरीज़ में टोन, वाक्यांश और तात्कालिकता (urgency) होती है जिसे स्टैटिक वेब टेक्स्ट की नकल नहीं की जा सकती।

डेवलपर्स, फाउंडर्स और प्रतिस्पर्धी परिदृश्य पर नज़र रखने वाले किसी भी व्यक्ति के लिए, इसका निहितार्थ सीधा है। वह "डेटा मोट" (data moat) जो एक लार्ज लैंग्वेज मॉडल को दूसरे से अलग करता है, वह तेजी से किसी प्लेटफॉर्म के अपने यूजर बेस के निजी इंटरैक्शन और अपलोड से तैयार किया जा रहा है। ओपन-सोर्स वेब क्रॉल अभी भी उपयोगी हैं, लेकिन अब सबसे उच्च-मूल्य वाला डेटा वह है जो आप किसी सर्विस में लॉग-इन रहते हुए और सक्रिय रूप से कुछ काम करने की कोशिश करते समय बनाते हैं।

निष्कर्ष

आपकी पुरानी प्राइवेसी प्लेबुक अब पुरानी हो चुकी है। Google के नए ट्रेनिंग डेटा शासन के लिए Search Services History के अंदर 'Save Media' बॉक्स को अनचेक करके एक विशिष्ट और जानबूझकर ऑप्ट-आउट करना आवश्यक है। वह कार्रवाई, एक सख्त ऑटो-डिलीट विंडो के साथ मिलकर, आपकी अपलोड की गई इमेज, ऑडियो और वीडियो को Google के AI ट्रेनिंग पाइपलाइन से बाहर रखने का एकमात्र विश्वसनीय तरीका है। इसे आगे बढ़ाएं। डिफ़ॉल्ट अब आपके पक्ष में नहीं है।