Anthropic sasa inaweka mfululizo wa takwimu uliofichwa—SynthID-Text—katika kila jibu la Claude. Kampuni hiyo inasema hatua hiyo inakidhi Kanuni ya Uwazi ya EU AI Act na kuwapa watengenezaji njia ya kuthibitisha kuwa maandishi fulani yametoka kwenye modeli ya AI. Alama ya maji (watermark) inastahimili uhariri wa kawaida huku ikiacha maandishi bila kubadilika kwa wasomaji wa kibinadamu.

Kwa nini alama ya maji inaongezwa

Wafuatiliaji wa sheria wa Ulaya wamehimiza watoa huduma za modeli kubwa za lugha (LLM) kufanya maudhui yanayozalishwa na AI yatofautishwe na maandishi ya kibinadamu. Kanuni ya Uwazi ya EU AI Act, ambayo hivi karibuni itatekelezwa kote katika kanda hiyo, inawalazimu watengenezaji kutoa njia ya kuaminika ya utambuzi kwa maandishi yoyote ambayo modeli zao zinazalisha. Anthropic ilijibu kwa kupitisha mbinu ya SynthID-Text iliyoelezwa kwa mara ya kwanza na Google DeepMind mwaka jana.

Uamuzi huo ulizua mjadala mkubwa kwenye Reddit na X, ambapo watumiaji walihofia kuwa alama hiyo inaweza kupunguza ubora wa matokeo au kuwa njia ya siri ya ufuatiliaji. Anthropic inapinga hilo kwa kusema kuwa mfululizo huo hauzioniwi na wasomaji, haucheleshi utendaji, na unaweza kuzimwa kwa matumizi ya faragha. Kwa kuchapisha maelezo ya kiufundi, kampuni hiyo inatumai kutuliza uvumi na kuweka kiwango cha kurejelea kwa sekta hiyo.

Jinsi SynthID-Text inavyofanya kazi

Mitambo ya kawaida ya utambuzi wa AI hutafuta mianya ya kilugha—maneno yanayojirudia, alama za uandishi zisizo za kawaida, au mabadiliko ya takwimu kutoka kwa maandishi ya kibinadamu. Ishara hizo hutoweka mara tu binadamu anapofanya upya uandishi wa aya, jambo linalofanya mitambo hiyo isiwe ya kuaminika. SynthID-Text, kinyume chake, inaweka ishara ya siri wakati wa hatua ya uteuzi wa token (token-selection step) ya modeli.

Wakati Claude anapochagua kati ya token mbili zinazowezekana sawa—kwa mfano “overcast” dhidi ya “grey”—mfumo unalega uamuzi kuelekea lile linaloendana na mfululizo wa binary uliopangwa mapema. Katika urefu wa hati, mienendo hii inatengeneza mfululizo wa bit ambazo API ya utambuzi inaweza kuzichukua baadaye. Mfululizo huo umekusudiwa kuwa na athari ndogo: neno mbadala lililochaguliwa bado ni neno la kawaida kabisa, hivyo mtiririko wa maandishi unabaki bila kubadilika. Kwa sababu alama ya maji ipo kwenye mtiririko wa token badala ya maandishi ya juu, inastahimili michakato mingi inayofuata ambayo haibadilishi kila token.

Ustahimilivu wa uhariri: nini kinabaki na nini hakibaki

Ukosoaji wa kawaida ni kwamba watumiaji wanaweza tu kuhariri maandishi yanayozalishwa na AI ili kufuta alama ya maji. Majaribio ya ndani ya Anthropic yanaainisha mazingira matatu ya uhariri:

  • Uhariri mwepesi – kurekebisha makosa ya uandishi, kubadilisha vivumishi vichache, au kurekebisha mpangilio wa sentensi. Saini ya takwimu ya alama ya maji inabaki vilevile kwa kiasi kikubwa kwa sababu token nyingi hazibadiliki.
  • Uhariri mzito unaosaidiwa na Claude – kumuelekeza Claude kuandika upya rasimu ambayo tayari ina sentensi zilizozalishwa na AI. Ikiwa mtumiaji anabaki na udhibiti wa maneno mengi, ishara ya alama ya maji inafifia kulingana na kiasi cha maandishi mapya yaliyochaguliwa na binadamu.
  • Kuandika upya kabisa – kubadilisha kila token na uundaji mpya au uandishi wa mkono. Katika hatua hiyo, alama ya maji ya awali inaharibiwa, lakini maandishi yanayotokana hayakidhi tena ufafanuzi wa EU wa “maudhui yanayozalishwa na AI” kwa sababu hakuna alama ya matokeo ya modeli ya awali inayobaki.

Hitimisho: alama ya maji inastahimili uboreshaji wa kawaida lakini si uundaji upya kamili wa maudhui.

Uundaji wa kodi: mahali alama ya maji ilipo

Claude hutumiwa sana kama msaidizi wa kodi, akitengeneza kila kitu kuanzia vipande vidogo vya kodi (snippets) hadi moduli kamili za full-stack. Lugha za programu zina nafasi ndogo ya kuchagua maneno mbadala; kubadilisha token kama “for” na “while” kungebadilisha mantiki. Kwa hivyo, Anthropic inatarajia alama ya maji ionekane karibu pekee katika sehemu ambapo modeli ina uhuru wa kuchagua maneno—maoni (comments), docstrings, na maandishi ya maelezo yanayoambatana na kodi.

Kwa sababu sehemu ya utendaji ya kodi inabaki bila kuguswa, watengenezaji hawapaswi kuona kupungua kwa usahihi au utendaji. Uwepo wa alama ya maji umezuiliwa kwenye maandishi ya ziada yanayosaidia binadamu kuelewa kodi, hivyo kukidhi hitaji la uwazi bila kuathiri manufaa.

Athari katika sekta

Anthropic haifanyi hivi peke yake. Watengenezaji kadhaa wengine wa LLM wamesaini Kanuni ya Utendaji (Code of Practice) ileile inayohitaji API ya utambuzi iliyosanifiwa. Ikiwa ratiba ya utekelezaji ya EU itaendelea kama ilivyopangwa, alama ya maji inaweza kuwa tabaka la kawaida katika mfumo wa LLM, kama vile usimbaji (encryption) unavyofanya kwa utumaji wa data leo. Makampuni yanayopuuza hitaji hilo yanahatarisha faini, kupoteza ufikiaji wa soko barani Ulaya, au kulazimishwa kuondoa huduma zao.

Hoja za kutofautiana

Critics argue that a hidden signature, even if invisible, could be repurposed for tracking or attribution beyond regulatory compliance. They also fear false positives: a detection API that mislabels human-written text could undermine trust in platforms that rely on the signal. Anthropic acknowledges these risks and says the detection algorithm will be open-source, allowing independent audits and calibration.

Another practical worry is the computational overhead of generating the watermark. Anthropic reports that the additional processing adds less than a fraction of a percent to inference time, a claim that third-party benchmarks will soon test.

What to watch next

  • API rollout – Anthropic plans to release a public endpoint that extracts the hidden bit pattern from any Claude output. Developers will be able to integrate the check into content-moderation pipelines.
  • Standardization efforts – Regulatory bodies and industry groups are drafting a common format for watermark metadata, which could make cross-model detection easier.
  • Empirical studies – Independent researchers are beginning to probe the resilience of SynthID-Text against adversarial rewriting tools. Their findings will shape how much confidence platforms place in the signal.

Bottom line

Anthropic’s adoption of SynthID-Text gives the AI community a concrete tool to meet upcoming European transparency rules while keeping Claude’s output quality intact. The watermark survives everyday proofreading but falls away when text is fully regenerated, and it lives in the non-code parts of programming output where it does not interfere with functionality. Whether the approach becomes the industry norm hinges on how well the detection API performs in real-world settings and whether concerns about privacy and false alarms can be addressed.