Anthropic telah mula melaksanakan penandaan air (watermarking) teks secara rasmi merentasi keluarga model Claude miliknya untuk meningkatkan ketelusan AI dan mematuhi peraturan yang sedang muncul. Walaupun syarikat tersebut menjanjikan integrasi yang lancar, satu perdebatan yang semakin meningkat muncul mengenai kesannya terhadap ketepatan linguistik dan implikasi undang-undang terhadap keaslian penulisan AI yang boleh dikesan.
Mekanisme Penandaan Air Terselindung
Pendekatan Anthropic dicontohi daripada metodologi SynthID-Text milik Google DeepMind. Berbeza dengan penandaan air tradisional, yang mungkin memasukkan label yang kelihatan atau aksara Unicode tersembunyi, sistem ini beroperasi pada tahap kebarangkalian Large Language Model (LLM). Ia berfungsi dengan mengubah suai sumber rawak yang digunakan semasa pemilihan token secara halus. Dengan melaraskan kebarangkalian pilihan perkataan tertentu, sistem ini mencipta corak yang boleh dikesan secara statistik yang boleh dikenal pasti oleh perisian khusus tanpa mengubah rupa visual teks tersebut.
Anthropic menegaskan bahawa proses ini tidak mempunyai kesan yang boleh diukur terhadap kreativiti atau kebolehbacaan output Claude. Untuk mengurangkan risiko dalam persekitaran berketepatan tinggi, syarikat itu menyatakan bahawa penandaan air adalah "lebih jarang" dalam petikan yang padat dengan fakta di mana kosa kata dihadkan oleh keperluan semantik.
Kritikan Linguistik: Ketepatan lwn. Pemolaan
Walaupun terdapat jaminan daripada Anthropic, pengkritik teknologi terkemuka seperti John Gruber dari Daring Fireball berhujah bahawa dakwaan "tidak dapat dikesan" itu cacat. Teras hujah tersebut terletak pada nuansa semantik: tiada dua sinonim yang boleh ditukar ganti dengan sempurna. Jika algoritma penandaan air mengutamakan token tertentu untuk mengekalkan corak statistik, ia mungkin mengetepikan perkataan yang lebih tepat demi perkataan yang "betul" secara statistik untuk penandaan air tersebut.
Gruber mencadangkan bahawa ini boleh membawa kepada kemerosotan kualiti teks secara halus, dengan menyatakan bahawa metrik semasa yang digunakan untuk mengesahkan sistem seperti SynthID—seperti penarafan "ibu jari ke atas/bawah" pengguna—adalah tidak mencukupi. Seorang pengguna berkemungkinan besar tidak akan menghukum model kerana memilih "grey" berbanding "overcast," walaupun yang terakhir memberikan kedalaman gaya yang lebih baik, bermakna "kualiti" teks tersebut mungkin terhakis dalam cara yang gagal ditangkap oleh penanda aras standard.
Implikasi Undang-undang dan Sifat Penanda yang "Melekat"
Pelancaran ini memperkenalkan kerumitan yang ketara bagi sektor profesional, terutamanya undang-undang. Menurut Artificial Lawyer, walaupun kebanyakan pelanggan tidak kisah dengan bantuan AI, keupayaan untuk membuktikan penglibatan AI menjadi liabiliti dalam kes di mana penggunaan AI dilarang secara nyata oleh hakim atau pelanggan.
Cabaran teknikal yang kritikal ialah "ketekalan" (persistence) penanda air ini. Oleh kerana penandaan tersebut tertanam dalam teks itu sendiri, ia boleh tersebar melalui dokumen. Kontrak yang dirangka oleh manusia yang mengandungi klausa yang dijana oleh AI akan membawa penanda air tersebut ke hadapan, yang berpotensi mencemari templat masa hadapan. Tambahan pula, memandangkan profesional undang-undang menggunakan pelbagai LLM, dokumen akhirnya mungkin mengandungi penanda air yang bertindih daripada penyedia yang berbeza, mewujudkan mimpi ngeri forensik untuk audit ketelusan.
Pematuhan dan Pengelakan
Langkah ini sebahagian besarnya didorong oleh keperluan untuk mematuhi EU AI Act, walaupun Anthropic melaksanakan ciri tersebut secara global untuk mengelakkan fragmentasi serantau. Semua model Claude yang dikeluarkan selepas 2 Ogos sudah menyokong penandaan air, dengan model lama dijadualkan untuk penambahbaikan (retrofitting). Walau bagaimanapun, keberkesanan sistem ini masih dipertikaikan; alatan seperti Declaude sudah pun digunakan untuk membuang penandaan ini melalui parafrasa, menunjukkan bahawa walaupun penandaan air mungkin memuaskan hati pengawal selia, ia mungkin sukar untuk menghalang pengelakan yang disengajakan.
Ringkasan Utama
- Pengesanan Kebarangkalian: Anthropic menggunakan kaedah gaya SynthID yang mengubah rawak pemilihan token dan bukannya menambah aksara yang kelihatan, menjadikan penanda air boleh dikesan secara statistik tetapi tersembunyi secara visual.
- Pertukaran Kualiti: Pengkritik berhujah bahawa memaksa pilihan perkataan tertentu untuk mengekalkan corak penanda air secara semula jadi mengorbankan ketepatan semantik dan nuansa gaya.
- Liabiliti Undang-undang: Sifat penanda air yang "melekat" bermakna teks yang dijana AI boleh membawa corak yang boleh dikesan ke dalam dokumen masa hadapan, mewujudkan risiko ketelusan bagi firma guaman dan industri yang dikawal selia dengan ketat.
