Google Gemini दृश्य AI वॉटरमार्क काढण्याची परवानगी देणार

Google एक असा 'टॉगल' (toggle) समाविष्ट करत आहे ज्यामुळे वापरकर्त्यांना तो “sparkle” आयकॉन लपवता येईल, जो सध्या त्याच्या Gemini मॉडेल्सद्वारे तयार केलेल्या प्रत्येक इमेज आणि व्हिडिओवर असतो. हा पर्याय Gemini आणि Flow व्हिडिओ जनरेटरमध्ये उपलब्ध असेल आणि पडताळणीसाठी तो एक अदृश्य डिजिटल फिंगरप्रिंट सुरक्षित ठेवतो.

हा बदल महत्त्वाचा आहे कारण क्रिएटर्सनी (निर्मात्यांनी) बऱ्याच काळापासून तक्रार केली आहे की, दृश्य वॉटरमार्क डिझाइनच्या सौंदर्यामध्ये अडथळा आणतो, तर दुसरीकडे नियमनकर्ते आणि प्लॅटफॉर्म्सना एखादे माध्यम AI द्वारे तयार केले आहे हे सिद्ध करण्यासाठी अजूनही एका विश्वसनीय मार्गाची गरज आहे. लेबल वापरकर्त्याच्या नजरेतून काढून बॅकग्राउंडमध्ये नेऊन, Google असा विश्वास ठेवत आहे की मशीन-रीडेबल मेटाडेटा दोन्ही बाजूंच्या गरजा पूर्ण करेल.

लक्षवेधी स्टॅम्प्सपासून लपलेल्या स्वाक्षरीपर्यंत

जेव्हा एखादा वापरकर्ता Gemini च्या Nano Banana किंवा Omni मॉडेल्सकडून इमेज मागतो, तेव्हा सिस्टम आपोआप खालच्या उजव्या कोपऱ्यात एक छोटा 'sparkle' आयकॉन दाखवते. ही खूण स्पष्टपणे ओळखता येते, परंतु यामुळे डिझाइनर्सना अंतिम उत्पादनात वापरण्यापूर्वी आउटपुट क्रॉप करणे, रिटच करणे किंवा इतर प्रकारे एडिट करणे भाग पडते.

Google चा नवीन “Media watermark” टॉगल फक्त ती दृश्य खूण बंद करतो. वापरकर्त्यापर्यंत पोहोचणारे कंटेंट एखाद्या हाताने एडिट केलेल्या व्हर्जनसारखेच दिसते, परंतु पृष्ठभागाखाली फाईलमध्ये अद्याप अदृश्य आयडेंटिफायर्सचा संच असतो. ही पावले अनेक क्रिएटर्स आधीच करत असलेल्या गोष्टींचे प्रतिबिंब आहे: आयकॉन मॅन्युअली पुसून टाकणे आणि फाईलचा मूळ स्रोत (provenance) सुरक्षित राहील यावर विश्वास ठेवणे.

अदृश्य मूळ स्रोत (provenance) सुरक्षित राहतो

Google म्हणते की ही लपलेली लेयर दोन घटकांपासून बनलेली असेल. पहिले म्हणजे, SynthID वॉटरमार्क पिक्सेल डेटामध्ये एक सूक्ष्म पॅटर्न एम्बेड करतो जो डोळ्यांना दिसत नाही परंतु Google च्या टूल्सद्वारे शोधता येतो. दुसरे म्हणजे, फाईलमध्ये C2PA मेटाडेटा समाविष्ट असेल—हे टॅग्सचा एक प्रमाणित संच आहे जो मूळ स्रोत, मॉडेल व्हर्जन आणि निर्मितीची तारीख दर्शवतो. 'sparkle' बंद असतानाही हे दोन्ही घटक कायम राहतात आणि ते Gemini द्वारे किंवा Google Search क्वेरीद्वारे वाचले जाऊ शकतात, जी सिस्टमला मूळ स्रोत पडताळण्यास सांगते.

हा दुहेरी दृष्टिकोन Google ला एक सुरक्षा कवच देतो. जर एखाद्या वापरकर्त्याला एखादे माध्यम AI द्वारे तयार केले आहे हे सिद्ध करायचे असेल, तर ते प्रेक्षकांना दृश्य वॉटरमार्क न दाखवता करू शकतात. हे अदृश्य मार्क इमेज रिसाईझ करणे किंवा कॉम्प्रेशन यांसारख्या सामान्य संपादनानंतरही टिकून राहतात, ज्यामुळे वितरणाच्या साखळीत (distribution chain) अखंडता राखण्यास मदत होते.

इतर कंपन्यांशी सुसंगतता

OpenAI, Meta आणि Anthropic यांनी आधीच अशाच प्रकारच्या केवळ अदृश्य रणनीती अवलंबल्या आहेत. OpenAI हे SynthID आणि C2PA च्या संयोजनावर अवलंबून आहे, Meta ने आपला स्वतःचा Content Seal स्टँडर्ड लाँच केला आहे, आणि Anthropic ने मजकूर आणि प्रतिमांसाठी अदृश्य वॉटरमार्कची घोषणा केली आहे. दृश्य वॉटरमार्क ऐच्छिक करून, Google उद्योग क्षेत्रातील त्या व्यापक ट्रेंडमध्ये सामील होत आहे जो समोर दिसणाऱ्या स्टॅम्प्सपेक्षा बॅकएंड डिजिटल स्वाक्षरीला प्राधान्य देतो.

हे एकत्रीकरण योगायोग नाही. गेल्या काही महिन्यांत, विविध प्लॅटफॉर्मवरील वापरकर्ते दृश्य आयकॉन्स काढून टाकत आहेत आणि या सामूहिक प्रतिसादाने प्रमुख AI लॅब्सना “metadata-first” मॉडेलकडे वळवले आहे. या बदलामुळे वापरकर्ता अनुभव (user experience) आणि नियमनकर्ते व डाउनस्ट्रीम प्लॅटफॉर्म्सची ट्रॅसेबिलिटीची (traceability) गरज यामधील तणावही कमी होतो.

अधिकारक्षेत्राच्या मर्यादा

हा टॉगल सर्वत्र उपलब्ध नसेल. ज्या देशांमध्ये कायद्यानुसार AI-निर्मित कंटेंटवर स्पष्ट दृश्य लेबल असणे आवश्यक आहे, तिथे Google डिफॉल्टनुसार 'sparkle' सुरू ठेवेल. वापरकर्त्याच्या आवडीवर न अवलंबून, त्या अधिकारक्षेत्रांमध्ये दृश्य वॉटरमार्क दिसणे सुरूच राहील.

हे निवडक रोलआउट जागतिक उत्पादन डिझाइन आणि स्थानिक नियामक आदेशांमधील सुरू असलेला संघर्ष दर्शवते. सीमापार काम करणाऱ्या कंपन्यांना अनेकदा कडक आवश्यकता पूर्ण करण्यासाठी वैशिष्ट्ये तयार करावी लागतात आणि Google प्रत्येक प्रकरणाचा विचार करून तसे करण्यास तयार असल्याचे दिसते.

क्रिएटर्स आणि प्लॅटफॉर्म्ससाठी परिणाम

डिझाइनर्स, मार्केटर्स आणि डेव्हलपर्ससाठी, याचा तात्काळ फायदा म्हणजे एक स्वच्छ (cleaner) एसेट, जो थेट लेआउट, जाहिरात किंवा सोशल पोस्टमध्ये वापरता येईल. अदृश्य मूळ स्रोत (provenance) असल्यामुळे, डाउनस्ट्रीम टूल्स—जसे की कंटेंट मॅनेजमेंट सिस्टम्स, ब्रँड-सेफ्टी फिल्टर्स किंवा सर्च इंजिन्स—गरज पडल्यास त्या साहित्याला AI-निर्मित म्हणून फ्लॅग करू शकतात.

मीडिया इंडेक्स किंवा क्युरेट करणाऱ्या प्लॅटफॉर्म्सनाही याचा फायदा होईल. लपलेले टॅग्स मशीन-रीडेबल असल्यामुळे, ऑटोमेटेड पाइपलाईन्स क्रॉप केलेले किंवा अस्पष्ट झालेले दृश्य संकेत न वापरता मूळ स्रोताचा डेटा समोर आणू शकतात. यामुळे कंप्लायन्स चेक (compliance checks) सुलभ होऊ शकतात आणि कंटेंट मॉडरेशनमधील 'फॉल्स पॉझिटिव्ह' (false positives) कमी होऊ शकतात.

मुख्य निष्कर्ष: Google चे नवीन सेटिंग AI-द्वारे तयार केलेल्या मीडियाचे लेबल फाईलच्या समोरून बॅकग्राउंडमध्ये हलवते, जे संपूर्ण उद्योगातील केवळ 'मेटाडेटा-ओन्ली अट्रिब्युशन' (metadata-only attribution) कडे झुकणाऱ्या बदलाचे प्रतिबिंब आहे. हा दृष्टिकोन पडताळणीयोग्य मूळ स्रोत (verifiable provenance) जपून क्रिएटिव्ह वर्कफ्लो सुलभ करतो, परंतु पारदर्शकता व्यापक जनतेसमोर कशी सादर केली जावी याबद्दल यामुळे नवीन प्रश्नही निर्माण होतात.