لقد غيرت Google قواعد اللعبة. إذا التقطت صورة عبر Google Lens الأسبوع الماضي، أو مارست عبارة إسبانية بصوت عالٍ في Google Translate، أو طلبت من Maps تحديد موقع لتناول الغداء، فقد يكون هذا المحتوى الآن في قائمة انتظار لتدريب نماذج الذكاء الاصطناعي التوليدي للشركة. قامت Google مؤخرًا بإعادة هيكلة بنية الخصوصية الخاصة بها بحيث يمكن الاحتفاظ بالصور والمقاطع الصوتية ومقاطع الفيديو التي يرفعها المستخدمون عبر منظومتها واستخدامها لبناء أنظمة تعلم الآلة. إنه تحول متعمد بعيدًا عن كشط صفحات الويب العامة نحو حصاد التفاعلات المباشرة والهادفة التي يجريها الأشخاص مع منتجات Google يوميًا.
التحول الهادئ في السياسة
هذا ليس تحديثًا روتينيًا لشروط الخدمة. لسنوات، تضمن النهج المعتاد لتدريب نماذج الذكاء الاصطناعي الكبيرة زحف مليارات صفحات الويب العامة، وجمع النصوص والصور والروابط التي كانت مرئية بالفعل للعالم. هذا النهج له حدود؛ فالويب المفتوح محدود، وفي العديد من المجالات، تم بالفعل استخراج البيانات العامة الأكثر قيمة وتغذيتها في الأنظمة الحالية. دفع المنافسون مثل Meta مؤخرًا نحو الاستفادة من المحتوى الذي ينشئه المستخدمون، وتتحرك Google الآن في الاتجاه نفسه.
وصل التحديث إلى المستخدمين من خلال بريد إلكتروني للعملاء قدم ضابطي خصوصية جديدين: Search Services History و Personalized Recommendations. في الظاهر، تبدو هذه أدوات تخصيص قياسية تهدف إلى تسريع استعلامك التالي أو تحسين توصياتك. ومع ذلك، إذا قرأت التفاصيل الدقيقة، فسيصبح النطاق واضحًا. تذكر Google أن الوسائط المحفوظة يمكن استخدامها لـ "تطوير وتحسين خدمات وتقنيات Google، بما في ذلك نماذج الذكاء الاصطناعي وتدابير السلامة". الصياغة فضفاضة، والإعداد الافتراضي هو "التشغيل"، ويتطلب إلغاء الاشتراك معرفة المكان الذي يجب البحث فيه.
ما تريده Google منك حقًا
تشمل مظلة جمع البيانات كل خدمة رئيسية من خدمات Google تقريبًا تلمسها. عندما يوجه سائح Google Lens نحو لافتة شارع أجنبية أو قائمة طعام، فإن المدخلات المرئية لا تختفي ببساطة بعد ظهور النتائج. عندما يستخدم طالب Google Translate لممارسة التحدث بصوت عالٍ، فإن التسجيلات الصوتية التي يتم التقاطها خلال تلك الجلسات تكون مؤهلة للاحتفاظ بها. تندرج استعلامات الصوت المرسلة عبر Search Live أو البحث الصوتي القياسي تحت نفس السياسة. حتى التفاعلات الروتينية مع Maps و Shopping و Flights و Hotels و News يمكن أن تولد وسائط تصنفها Google الآن كمواد تدريب.
سابقًا، كان بإمكان المستخدمين المهتمين بالخصوصية الاعتماد على مفتاح Web & App Activity للحد من مقدار بيانات التفاعل التي تحتفظ بها Google. لم تعد هذه الاستراتيجية تعمل؛ فقد فصلت Google هذه الإعدادات الجديدة صراحةً عن Web & App Activity. يعد Search Services History ضابطًا مستقلاً، وهو مفعل بشكل افتراضي، وأي خيارات اتخذتها في لوحة تحكم الخصوصية الخاصة بك قبل عامين أو ثلاثة أعوام لن تمنع تخزين الوسائط المتعلقة بالبحث لتدريب الذكاء الاصطناعي. مفتاح الإيقاف القديم لم يعد يتحكم في هذه الدائرة تحديدًا.
كيفية إلغاء الاشتراك فعليًا
توفر Google خيارًا يدويًا للتجاوز، ولكن العبء يقع عليك بالكامل. لا يوجد مفتاح تبديل شامل للحساب يعطل جمع بيانات تدريب الذكاء الاصطناعي بنقرة واحدة. ستحتاج إلى زيارة صفحتين محددتين داخل لوحة تحكم حساب Google الخاص بك: صفحة Search Services History وصفحة Search Services Personalization.
بمجرد دخولك إلى Search Services History، قم بالتمرير حتى تجد مربع اختيار "Save Media". قم بإلغاء تحديده. هذا الإجراء المنفرد هو ما يمنع تخزين الصور والصوت والفيديو في المستقبل واحتمالية تغذيتها في تدريب النماذج. لا تفترض أن تعطيل Web & App Activity سيتولى هذا الأمر نيابة عنك، فلن يفعل ذلك. الفصل صريح ومن السهل تفويته، مما يعني أن العديد من المستخدمين سيعتقدون أنهم ألغوا الاشتراك بينما لم يفعلوا ذلك.
بعد تعطيل حفظ الوسائط، قم بتكوين تفضيلات الحذف التلقائي أثناء تواجدك في نفس لوحة التحكم. توفر Google ثلاثة خيارات: حذف البيانات بعد 3 أشهر، أو 18 شهرًا، أو 36 شهرًا. إذا كنت تريد أقصى قدر من التحكم، فاختر نافذة الثلاثة أشهر. هذه هي أقصر دورة تنظيف تسمح بها Google من خلال هذا الضابط، وهي تحد من تراكم تفاعلاتك التاريخية. ضع في اعتبارك أن إيقاف "Save Media" يوقف الجمع المستقبلي فقط، أما أي شيء سجلته Google بالفعل بموجب الإعدادات السابقة فقد يظل في التخزين ما لم تقم بحذف سجلّك الحالي يدويًا من خلال أدوات الحساب نفسها.
إذا كنت تدير حسابًا عائليًا مشتركًا أو مساحة عمل يتفاعل فيها عدة أشخاص مع خدمات Google، فيجب على كل شخص لديه صلاحية الوصول مراجعة هذه الإعدادات بشكل فردي. فخيارات التحكم في التخصيص مرتبطة بالحساب وليس بالجهاز، ويُطبق خيار الاشتراك التلقائي (opt-in) الافتراضي على الجميع.
ما يخبرنا به هذا عن المرحلة القادمة للذكاء الاصطناعي
يُعد هذا التغيير في السياسة إشارة واضحة إلى الاتجاه الذي يسلكه هذا القطاع. لقد تم استخراج المواد التدريبية من الويب العام بشكل شامل. والحدود التالية لتحسين النماذج اللغوية الكبيرة (large language models) والأنظمة متعددة الوسائط (multimodal systems) هي البيانات المملوكة التي ينشئها أشخاص حقيقيون داخل المنصات المغلقة. فعمليات البحث المرئي الخاصة بك تحتوي على سياق مكاني، وجلسات ممارسة الترجمة الخاصة بك تحتوي على أنماط النطق والقصد الحواري، كما تحتوي استعلاماتك الصوتية على النبرة والصياغة والاستعجال، وهي أمور لا يمكن للنصوص الثابتة على الويب محاكاتها.
بالنسبة للمطورين والمؤسسين وكل من يراقب المشهد التنافسي، فإن النتيجة واضحة. إن "الخندق المائي للبيانات" (data moat) الذي يفصل نموذجًا لغويًا كبيرًا عن آخر يتم حفره بشكل متزايد من التفاعلات والتحميلات الخاصة بقاعدة مستخدمي المنصة نفسها. لا تزال عمليات الزحف عبر الويب مفتوحة المصدر مفيدة، ولكن البيانات ذات القيمة الأعلى هي الآن تلك التي تنشئها أثناء تسجيل الدخول إلى خدمة ما ومحاولتك بنشاط إنجاز أمر ما.
الخلاصة
إن استراتيجيتك القديمة للخصوصية قد عفا عليها الزمن. يتطلب نظام بيانات التدريب الجديد من Google إلغاء اشتراك (opt-out) محدد ومتعمد داخل Search Services History عن طريق إلغاء تحديد مربع Save Media. هذا الإجراء، مقترنًا بضبط نافذة حذف تلقائي ضيقة، هو الطريقة الوحيدة الموثوقة لإبقاء صورك ومقاطعك الصوتية والمرئية التي قمت بتحميلها بعيدًا عن مسار تدريب الذكاء الاصطناعي الخاص بـ Google. انشر هذه المعلومة؛ فالإعدادات الافتراضية لم تعد تصب في مصلحتك.