De nieuwste Claude-modellen van Anthropic voegen een onzichtbaar watermerk toe aan elk gegenereerd tekstfragment. De wijziging, die op 2 augustus in de bijgewerkte documentatie werd aangekondigd, voegt een statistisch signaal direct toe aan woordkeuzes en zinsstructuren — niet als een zichtbare tag of metadata-veld.

Wat het watermerk is

Het watermerk is een subtiel patroon dat in de taal zelf is verweven. Door het model te sturen naar bepaalde synoniemen, interpunctieplaatsing of zinsritmes, creëert Anthropic een vingerafdruk die bestand is tegen gewoon kopiëren en plakken en lichte bewerkingen. Alleen ingrijpend herschrijven, meerdere rondes vertalen of het mengen met een aanzienlijke hoeveelheid door mensen geschreven tekst wist het signaal.

Omdat het watermerk in de tekst zelf zit, gaat het mee met de inhoud waar deze ook naartoe gaat — via de Claude.ai web UI, de API, Claude Code, en zelfs implementaties op AWS of Google Cloud die gebruikmaken van de modellen van Anthropic.

Hoe het bewerkingen overleeft

Typische 'human-in-the-loop'-workflows — zoals correctrolezen, de toon aanpassen of een paar woorden vervangen door synoniemen — wissen het watermerk niet uit. De documentatie van Anthropic stelt dat deze kleine wijzigingen "het signaal niet verwijderen", wat betekent dat de output nog steeds als door Claude gegenereerd herkenbaar zal zijn nadat een reviewer ermee aan de slag is gegaan.

Aggressievere transformaties doorbreken het patroon:

  • Zinnen volledig herschrijven
  • De tekst herhaaldelijk naar een andere taal vertalen en weer terug
  • Grote blokken door mensen geschreven proza invoegen

Deze acties kosten tijd of moeite en kunnen de kwaliteit of de bedoeling van de oorspronkelijke output verminderen.

Impact op workflows voor ontwikkelaars

Ontwikkelaars die Claude gebruiken voor het opstellen van outlines, codecommentaren of marketingteksten, worden nu geconfronteerd met een nieuwe compliance-hindernis. De EU AI Act, die transparantie voor door AI gegenereerde inhoud verplicht stelt, vormt het juridische kader voor de stap van Anthropic, waardoor het watermerk effectief een regelgevende waarborg wordt.

Er zijn drie strategieën naar voren gekomen:

  1. Vertalingsketens – Haal de Claude-output door meerdere taalvertalingen om het watermerk te verstoren. Deze methode is tijdrovend en kan vertaalfouten introduceren.
  2. Handmatig overtypen – Typ de tekst met de hand over om het verborgen patroon te elimineren. Dit werkt, maar is niet schaalbaar voor grote volumes.
  3. Volledig herschrijven – Gebruik Claude voor ideeën of structuur, en schrijf vervolgens elke zin zelf. Dit behoudt de creatieve vonk terwijl je ervoor zorgt dat de uiteindelijke tekst geen watermerk bevat; ontwikkelaars beschouwen dit als de meest praktische aanpak, ondanks de extra schrijfbelasting.

Elke methode is een afweging tussen snelheid, kosten en de getrouwheid aan de oorspronkelijke modeloutput.

False positives en het detectiedilemma

Een aanhoudende zorg is dat het statistische karakter van het watermerk kan overlappen met authentiek menselijk schrijven. Claude leert van publiekelijk beschikbare tekst, waardoor de stilistische vingerafdrukken soms die van menselijke auteurs nabootsen. Detectietools die het watermerk markeren, kunnen daardoor door mensen geschreven materiaal onterecht als door AI gegenereerd classificeren — een 'false positive' die ongewenste compliance-controles kan uitlokken.

Anthropic ontwikkelt een eigen detectietool, maar deze is nog niet uitgebracht. Zonder een validator kunnen ontwikkelaars niet testen of hun gekozen workflow het watermerk succesvol verwijdert of dat hun inhoud onterecht wordt gemarkeerd.

Waar u op moet letten

  • Release van de detector van Anthropic – Zodra deze beschikbaar is, kunnen teams hun workflows toetsen aan een officiële standaard.

Conclusie

Het onzichtbare watermerk van Anthropic dwingt tot een verschuiving van "genereren en publiceren" naar "genereren en controleren". Ontwikkelaars moeten beslissen of ze investeren in vertaalpijplijnen, handmatig overtypen of volledig herschrijven om onder de vlaggen voor AI-auteurschap uit te blijven, terwijl ze tegelijkertijd moeten navigeren door het risico op false positives die menselijk werk onterecht als door een machine gegenereerd kunnen labelen.