Title: OpenAI ने ChatGPT द्वारे डेस्कटॉप ॲक्टिव्हिटी ट्रॅक करण्यासाठी Computer History लाँच केले
OpenAI ने macOS ChatGPT ॲपमध्ये Computer History नावाचे एक नवीन फीचर आणले आहे, जे क्लिक्स, कीस्ट्रोक्स (keystrokes) आणि इतर इव्हेंट-लेव्हल सिग्नल्स रेकॉर्ड करते. हे मॉडेल स्क्रीनशॉट न घेता वापरकर्त्याच्या अलीकडील डेस्कटॉप ॲक्टिव्हिटीचा संदर्भ घेऊ शकते. कच्च्या इंटरअॅक्शन डेटाचे टाइमलाइनमध्ये रूपांतर करून, हे फीचर ChatGPT ला केवळ प्रतिक्रिया देणाऱ्या चॅटबॉटपासून एका सक्रिय (proactive) असिस्टंटमध्ये बदलण्याचे उद्दिष्ट ठेवते. हे असिस्टंट शेवटचे संपादित केलेले डॉक्युमेंट शोधू शकते, ते Slack वर शेअर केले गेले आहे की नाही याची खात्री करू शकते किंवा सकाळचा प्रॉडक्टिव्हिटी रिकॅप देऊ शकते—आणि हे सर्व करताना व्हिज्युअल कॅप्चर (visual capture) टाळले जाते.
हे फीचर कसे कार्य करते
ॲप सुरू होताच Computer History एक कालानुक्रमिक लॉग (chronological log) तयार करते. प्रत्येक एन्ट्रीमध्ये कोणते विंडो सक्रिय होते, कोणता बटण दाबले गेले आणि कोणता मजकूर टाईप केला गेला याची नोंद असते, परंतु ते कधीही इमेज, व्हिडिओ किंवा ऑडिओ स्टोअर करत नाही. हा लॉग डिव्हाइसवरच राहतो आणि जेव्हा वापरकर्ता ChatGPT सेशन सुरू करतो, तेव्हाच तो लार्ज लँग्वेज मॉडेलला उपलब्ध करून दिला जातो. प्रत्यक्ष वापरात, वापरकर्त्याला फाईल्स कॉपी-पेस्ट करण्याची किंवा संदर्भाचे मॅन्युअली वर्णन करण्याची गरज न पडता, मॉडेल टाइमलाइनमधून “मी नुकतीच कोणती फाईल संपादित केली?” किंवा “मी तो ड्राफ्ट सहकाऱ्याला पाठवला का?” यांसारख्या प्रश्नांची उत्तरे देऊ शकते.
OpenAI च्या डेव्हलपर टीमने अशा एका वर्कफ्लोचे प्रात्यक्षिक दाखवले जिथे AI ने सर्वात अलीकडील डॉक्युमेंट शोधले, मेसेजिंग प्लॅटफॉर्मवरील त्याची शेअरिंग स्थिती तपासली आणि त्यानंतर दिवसाच्या क्रियाकलापांचा संक्षिप्त सारांश तयार केला. अनेक ॲप्समधील सिग्नल्स एकत्र करून, असिस्टंट पुनरावृत्ती होणाऱ्या स्टेप्ससाठी ऑटोमेशन सुचवू शकते किंवा वापरकर्त्याला अपूर्ण काम पूर्ण करण्यासाठी प्रोत्साहन देऊ शकते.
प्रायव्हसी-फर्स्ट आर्किटेक्चर
Microsoft च्या Recall फीचरसारख्या स्पर्धक सेवांपेक्षा सर्वात मोठा फरक म्हणजे गोळा केला जाणारा डेटा प्रकार. Recall व्हिज्युअल हिस्ट्री तयार करण्यासाठी वारंवार स्क्रीनशॉट घेण्यावर अवलंबून असते; तर Computer History पूर्णपणे मेटाडेटा-समृद्ध "इव्हेंट्स" (events) वर अवलंबून आहे. OpenAI ने म्हटले आहे की, सिस्टिम इनकॉग्निटो (incognito) किंवा प्रायव्हेट-ब्राउझिंग मोडमध्ये घडणाऱ्या कोणत्याही ॲक्टिव्हिटीला आपोआप वगळते आणि ती कधीही असे पिक्सेल डेटा कॅप्चर करत नाही ज्यामुळे संवेदनशील व्हिज्युअल माहिती उघड होऊ शकते.
OpenAI चे प्रॉडक्ट आणि इंजिनिअरिंग लीड, एरी वेनस्टीन (Ari Weinstein) यांनी या गोष्टीवर भर दिला की हे फीचर 'ऑप्ट-इन' (opt-in) आहे. वापरकर्त्यांना हिस्ट्री लॉगर स्पष्टपणे सक्षम (enable) करावा लागेल आणि काय रेकॉर्ड करायचे आहे याचे ते सूक्ष्म नियंत्रण (fine-tune) करू शकतात:
- App exclusion – विशिष्ट प्रोग्राम्स किंवा वेबसाइट्स ब्लॅकलिस्ट करा जेणेकरून त्या लॉगमध्ये कधीही दिसणार नाहीत.
- Manual deletion – मॉडेलच्या मेमरीमधून विशिष्ट कृती पुसून टाकण्यासाठी वैयक्तिक एन्ट्रीज काढून टाका.
- Granular controls – विशिष्ट वेळेसाठी लॉगर चालू किंवा बंद करा, ज्यामुळे असिस्टंटला केवळ वापरकर्ता इच्छित तेव्हाच डेटा दिसेल याची खात्री होईल.
या सुरक्षा उपायांचा उद्देश वैयक्तिक वापरकर्ते आणि एंटरप्राइझ IT विभागांना हे आश्वासन देणे आहे की असिस्टंट गुपचूप व्हिज्युअल कंटेंट गोळा करणार नाही किंवा खाजगी संभाषणे ऐकणार नाही.
उत्पादकता आणि मार्केटसाठी हे का महत्त्वाचे आहे
जर टाइमलाइन विश्वसनीय असेल, तर AI ॲप्समधील हालचालींमधील अडथळे कमी करू शकते. फाईल उघडणे, तिचा पाथ (path) कॉपी करणे आणि तो प्रॉम्प्टमध्ये पेस्ट करण्याऐवजी, वापरकर्ता फक्त “मी दुपारच्या जेवणानंतर कशावर काम केले?” असे विचारू शकतो आणि तयार उत्तर मिळवू शकतो. कोड एडिटर्स, डिझाइन टूल्स आणि कम्युनिकेशन प्लॅटफॉर्म्सचा वापर करणाऱ्या पॉवर युजर्ससाठी, यामुळे होणारी 'कॉन्टेक्स्ट-स्विच' (context-switch) मधील बचत वेळेची मोठी बचत करू शकते.
मार्केटच्या दृष्टीने, हे पाऊल OpenAI च्या "agentic AI" कडे असलेल्या ओढीचे संकेत देते – अशी सिस्टिम्स जी ऑपरेटिंग एन्व्हायरनमेंटच्या सततच्या व्ह्यूवर आधारित वापरकर्त्यांच्या वतीने काम करतात. स्क्रीन कॅप्चरवर अवलंबून असलेल्या स्पर्धकांना अधिक नियामक तपासणी (regulatory scrutiny) आणि वापरकर्त्यांच्या संशयाचा सामना करावा लागतो; तर इव्हेंट-आधारित लॉगिंग समृद्ध संदर्भ प्रदान करत असतानाच यातील अनेक चिंता टाळते. प्रायव्हसीच्या कारणास्तव ज्या एंटरप्राइजेसनी स्क्रीन-कॅप्चर टूल्स ब्लॉक केली आहेत, त्यांना Computer History हा AI-असिस्टेड वर्कफ्लोसाठी एक व्यवहार्य मार्ग वाटू शकतो.
नाण्याला दुसरी बाजू देखील आहे
स्क्रीनशॉट नसले तरीही, प्रत्येक क्लिक आणि कीस्ट्रोकचा लॉग ठेवणे धोक्याची घंटा (red flags) उभारू शकते. टीकाकारांचे म्हणणे आहे की मेटाडेटा अजूनही संवेदनशील हेतू उघड करू शकतो: वैद्यकीय संज्ञांसाठी केलेली शोधमोहीम, फाईल नावांचा पॅटर्न किंवा गोपनीय कागदपत्रांशी संबंधित संवादाची वेळ यावरून खाजगी माहितीचा अंदाज लावता येऊ शकतो. 'ऑप्ट-इन' मॉडेलमुळे जोखीम कमी होते, परंतु ते वापरकर्त्यांनी योग्य वेळी फीचर सक्षम किंवा अक्षम करण्याच्या सवयीवर अवलंबून असते—जी सवय पाळणे कठीण असू शकते.
डेटा रेसिडेन्सीचा प्रश्न देखील आहे. हे फीचर इव्हेंट लॉग स्थानिक पातळीवर साठवते, परंतु जेव्हा वापरकर्ता चॅट सुरू करतो, तेव्हा इन्फरन्ससाठी इतिहासाचा संबंधित भाग OpenAI च्या सर्व्हर्सवर पाठवला जातो. कंपनीचे म्हणणे आहे की ही माहिती एनक्रिप्टेड स्वरूपात पाठवली जाते आणि विनंतीसाठी आवश्यक असलेला केवळ किमान संदर्भच पाठवला जातो, तरीही मोठ्या प्रमाणावर हे टूल स्वीकारण्यापूर्वी कंपन्या ऑन-प्रिमाइसेस प्रोसेसिंग किंवा अधिक कडक डेटा-हँडलिंग करारांची मागणी करू शकतात.
पुढे काय पाहावे
OpenAI ने macOS व्यतिरिक्त इतर प्लॅटफॉर्मसाठी रोलआउट वेळापत्रक जाहीर केलेले नाही, परंतु याचे आर्किटेक्चर प्लॅटफॉर्म-अज्ञेय (platform-agnostic) आहे, ज्याचा अर्थ Windows आणि Linux आवृत्त्या देखील येऊ शकतात. पुढील तार्किक पाऊल म्हणजे पॉलिसी कंट्रोल्स, ऑडिट लॉग्स आणि इन्फरन्स पूर्णपणे कॉर्पोरेट फायरवॉलच्या आत ठेवण्याची क्षमता असलेले एंटरप्राइझ-ग्रेड ऑफरिंग असेल.
EU आणि US मधील नियामक आता वापरकर्त्याच्या हालचालींचा डेटा घेणाऱ्या AI सिस्टम्सवर लक्ष केंद्रित करू लागले आहेत. "पारदर्शक AI" (transparent AI) बाबतच्या कोणत्याही भविष्यातील अनिवार्यतेमुळे OpenAI ला नेमके कोणते इव्हेंट लॉग केले जातात आणि ते कसे कमी (pruned) केले जातात, हे उघड करावे लागू शकते. प्रायव्हसी पॉलिसीमधील अपडेट्स आणि "कोणतेही व्हिज्युअल कॅप्चर नाही" (no visual capture) या दाव्याची पडताळणी करणाऱ्या थर्ड-पार्टी ऑडिट्सकडे लक्ष ठेवा.
सारांश
Computer History व्हिज्युअल सर्व्हेलन्सऐवजी इव्हेंट-लेव्हल लॉगिंगचा पर्याय देते, ज्यामुळे ChatGPT ला वापरकर्त्याच्या अलीकडील डेस्कटॉप जीवनाची झलक मिळते आणि सोबतच अधिक मजबूत प्रायव्हसीची खात्रीही दिली जाते. जर हे संतुलन कायम राहिले—म्हणजेच उपयुक्त ठरेल इतका पुरेसा संदर्भ आणि गोपनीयता धोक्यात येणार नाही इतका मर्यादित डेटा—तर हे फीचर पुढच्या पिढीच्या वैयक्तिक AI असिस्टंट्सचा आधारस्तंभ बनू शकते, ज्यामुळे आपण आपल्या मशीनशी संवाद कसा साधतो याला एक नवीन आकार मिळेल.
