Google hat die Spielregeln geändert. Wenn Sie letzte Woche ein Foto mit Google Lens gemacht, einen spanischen Satz laut mit Google Translate geübt oder Maps nach einem Mittagessen gefragt haben, könnten diese Inhalte nun in einer Warteschlange liegen, um die generativen KI-Modelle des Unternehmens zu trainieren. Google hat vor Kurzem seine Datenschutzarchitektur umstrukturiert, sodass Bilder, Audioclips und Videos, die Nutzer in seinem Ökosystem hochladen, gespeichert und zum Aufbau von Machine-Learning-Systemen verwendet werden können. Es ist eine bewusste Abkehr vom Scraping öffentlicher Webseiten hin zur Ernte der direkten, hochgradig zielgerichteten Interaktionen, die Menschen jeden Tag mit Google-Produkten haben.
Der stille Richtlinienwechsel
Dies ist kein routinemäßiges Update der Nutzungsbedingungen. Jahrelang bestand das Standardvorgehen für das Training großer KI-Modelle darin, Milliarden von öffentlichen Webseiten zu crawlen und Texte, Bilder und Links zu sammeln, die bereits für die Welt sichtbar waren. Dieser Ansatz hat Grenzen. Das offene Web ist endlich, und in vielen Bereichen wurden die wertvollsten öffentlichen Daten bereits extrahiert und in bestehende Systeme eingespeist. Wettbewerber wie Meta haben sich kürzlich in Richtung der Nutzung von nutzergenerierten Inhalten bewegt, und Google geht nun denselben Weg.
Das Update erreichte die Nutzer durch eine E-Mail, in der zwei neue Datenschutzoptionen vorgestellt wurden: Search Services History und Personalized Recommendations. Oberflächlich betrachtet klingen dies nach Standard-Personalisierungswerkzeugen, die dazu dienen, Ihre nächste Suchanfrage zu beschleunigen oder Ihre Empfehlungen zu verfeinern. Wer jedoch das Kleingedruckte liest, erkennt den Umfang. Google gibt an, dass gespeicherte Medien verwendet werden können, um „Google-Dienste und -Technologien zu entwickeln und zu verbessern, einschließlich KI-Modellen und Sicherheitsmaßnahmen“. Die Formulierung ist breit gefasst, die Standardeinstellung ist aktiviert, und um dies zu deaktivieren, muss man genau wissen, wo man suchen muss.
Was Google eigentlich von Ihnen will
Der Schirm der Datenerfassung umfasst fast jeden wichtigen Google-Dienst, den Sie nutzen. Wenn ein Tourist Google Lens auf ein ausländisches Straßenschild oder eine Speisekarte richtet, verschwindet der visuelle Input nicht einfach, nachdem die Ergebnisse angezeigt wurden. Wenn ein Schüler Google Translate verwendet, um das Sprechen laut zu üben, sind die während dieser Sitzungen aufgenommenen Audioaufnahmen für die Speicherung vorgesehen. Sprachanfragen, die über Search Live oder die Standard-Sprachsuche gesendet werden, fallen unter dieselbe Richtlinie. Sogar routinemäßige Interaktionen mit Maps, Shopping, Flights, Hotels und News können Medien erzeugen, die Google nun als Trainingsmaterial klassifiziert.
Zuvor konnten sich Nutzer, denen Datenschutz wichtig war, auf den Schalter Web & App Activity verlassen, um zu begrenzen, wie viele dieser Interaktionsdaten Google speichert. Diese Strategie funktioniert nicht mehr. Google hat diese neuen Einstellungen explizit von der Web & App Activity entkoppelt. Search Services History ist eine eigenständige Steuerung. Sie ist standardmäßig aktiviert, und welche Entscheidungen Sie auch vor zwei oder drei Jahren in Ihrem Datenschutz-Dashboard getroffen haben – sie werden nicht verhindern, dass Ihre suchbezogenen Medien für das KI-Training gespeichert werden. Der alte „Aus“-Schalter steuert diesen speziellen Schaltkreis nicht mehr.
So können Sie sich tatsächlich abmelden
Google bietet zwar eine manuelle Übersteuerung an, aber die Last liegt vollständig bei Ihnen. Es gibt keinen Konten-weiten Schalter, der die Erfassung von KI-Trainingsdaten mit einem Klick deaktiviert. Sie müssen zwei spezifische Seiten in Ihrem Google-Konto-Dashboard besuchen: die Seite Search Services History und die Seite Search Services Personalization.
Sobald Sie sich in der Search Services History befinden, scrollen Sie, bis Sie das Kontrollkästchen „Save Media“ finden. Deaktivieren Sie es. Diese eine Aktion verhindert, dass zukünftige Bilder, Audio- und Videoinhalte gespeichert und potenziell in das Modelltraining eingespeist werden. Gehen Sie nicht davon aus, dass die Deaktivierung der Web & App Activity dies für Sie erledigt. Das wird sie nicht. Die Entkopplung ist explizit und leicht zu übersehen, was bedeutet, dass viele Nutzer glauben werden, sie hätten sich abgemeldet, obwohl dies nicht der Fall ist.
Nachdem Sie das Speichern von Medien deaktiviert haben, konfigurieren Sie Ihre Einstellungen zur automatischen Löschung, während Sie sich noch im selben Dashboard befinden. Google bietet drei Optionen an: Daten nach 3 Monaten, 18 Monaten oder 36 Monaten löschen. Wenn Sie die größtmögliche Kontrolle wünschen, wählen Sie das Drei-Monats-Fenster. Dies ist der kürzeste Bereinigungszyklus, den Google über diese Steuerung ermöglicht, und er begrenzt den Rückstau Ihrer historischen Interaktionen. Bedenken Sie, dass das Deaktivieren von „Save Media“ die zukünftige Erfassung stoppt. Alles, was Google unter den vorherigen Einstellungen bereits protokolliert hat, kann in der Speicherung verbleiben, sofern Sie Ihren bestehenden Verlauf nicht manuell über dieselben Kontofunktionen löschen.
Wenn Sie ein gemeinsames Familienkonto oder einen Workspace verwalten, in dem mehrere Personen mit Google-Diensten interagieren, sollte jeder mit Zugriff diese Einstellungen individuell überprüfen. Die Personalisierungssteuerung ist an das Konto gebunden, nicht an das Gerät, und die standardmäßige Opt-in-Einstellung gilt für alle.
Was uns dies über die nächste Phase der KI verrät
Diese Richtlinienänderung ist ein klares Signal dafür, wohin sich die Branche entwickelt. Das öffentliche Web wurde bereits gründlich als Trainingsmaterial ausgeschöpft. Die nächste Grenze zur Verbesserung von Large Language Models und multimodalen Systemen sind proprietäre Daten, die von echten Menschen innerhalb geschlossener Plattformen generiert werden. Ihre visuellen Suchanfragen enthalten räumlichen Kontext. Ihre Übungssitzungen für Übersetzungen enthalten Aussprachemuster und konversationelle Absichten. Ihre Sprachabfragen enthalten Tonfall, Formulierung und Dringlichkeit, die statischer Webtext nicht replizieren kann.
Für Entwickler, Gründer und alle, die die Wettbewerbslandschaft beobachten, ist die Implikation eindeutig. Der „Daten-Burggraben“ (Data Moat), der ein Large Language Model von einem anderen unterscheidet, wird zunehmend aus den privaten Interaktionen und Uploads der eigenen Nutzerbasis einer Plattform gewonnen. Open-Source-Web-Crawls sind nach wie vor nützlich, aber die wertvollsten Daten sind heute jene, die Sie erstellen, während Sie in einem Dienst angemeldet sind und aktiv versuchen, etwas zu erledigen.
Das Fazit
Ihr bisheriges Datenschutz-Konzept ist veraltet. Googles neues Trainingsdaten-Regime erfordert ein gezieltes, bewusstes Opt-out innerhalb der Search Services History, indem Sie das Kontrollkästchen „Save Media“ deaktivieren. Diese Maßnahme, kombiniert mit einem kurzen Zeitfenster für die automatische Löschung, ist der einzige zuverlässige Weg, um Ihre hochgeladenen Bilder, Audio- und Videodateien aus Googles KI-Trainingspipeline fernzuhalten. Geben Sie es weiter. Die Standardeinstellungen sind nicht länger zu Ihren Gunsten gesetzt.