Anthropic ได้เริ่มดำเนินการติดตั้งลายน้ำในข้อความ (text watermarking) อย่างเป็นทางการในตระกูลโมเดล Claude เพื่อเพิ่มความโปร่งใสของ AI และปฏิบัติตามกฎระเบียบที่กำลังเกิดขึ้น แม้ว่าบริษัทจะให้คำมั่นว่าจะมีการบูรณาการที่ราบรื่น แต่ก็เริ่มมีข้อถกเถียงที่เพิ่มมากขึ้นเกี่ยวกับผลกระทบต่อความแม่นยำทางภาษาและนัยทางกฎหมายของการระบุความเป็นผู้เขียนโดย AI ที่สามารถตรวจจับได้

กลไกของการทำลายน้ำแบบแนบเนียน

แนวทางของ Anthropic ได้รับต้นแบบมาจากวิธีการ SynthID-Text ของ Google DeepMind ซึ่งต่างจากการทำลายน้ำแบบดั้งเดิมที่อาจมีการใส่ป้ายกำกับที่มองเห็นได้หรือตัวอักษร Unicode ที่ซ่อนอยู่ ระบบนี้ทำงานในระดับความน่าจะเป็นของโมเดลภาษาขนาดใหญ่ (LLM) โดยการปรับเปลี่ยนแหล่งที่มาของความสุ่มที่ใช้ในระหว่างการเลือกโทเคน (token selection) อย่างแนบเนียน การปรับความน่าจะเป็นในการเลือกคำเฉพาะเจาะจงจะทำให้ระบบสร้างรูปแบบที่สามารถตรวจจับได้ทางสถิติ ซึ่งสามารถระบุได้ด้วยซอฟต์แวร์เฉพาะทางโดยไม่เปลี่ยนแปลงรูปลักษณ์ภายนอกของข้อความ

Anthropic ยืนยันว่ากระบวนการนี้ไม่มีผลกระทบที่วัดได้ต่อความคิดสร้างสรรค์หรือความสามารถในการอ่านของผลลัพธ์จาก Claude และเพื่อลดความเสี่ยงในสภาพแวดล้อมที่ต้องการความแม่นยำสูง บริษัทระบุว่าการทำลายน้ำจะมีความ "เบาบาง" ลงในส่วนที่มีเนื้อหาเน้นข้อเท็จจริงซึ่งคำศัพท์ถูกจำกัดด้วยความจำเป็นทางอรรถศาสตร์ (semantic necessity)

การวิพากษ์วิจารณ์ทางภาษาศาสตร์: ความแม่นยำ ปะทะ การสร้างรูปแบบ

แม้จะมีการยืนยันจาก Anthropic แต่นักวิจารณ์เทคโนโลยีชื่อดังอย่าง John Gruber จาก Daring Fireball โต้แย้งว่าข้ออ้างที่ว่า "ไม่สามารถสังเกตเห็นได้" นั้นมีข้อบกพร่อง หัวใจสำคัญของข้อโต้แย้งนี้อยู่ที่ความละเอียดอ่อนทางอรรถศาสตร์: ไม่มีคำพ้องความหมายคู่ใดที่สามารถใช้แทนกันได้อย่างสมบูรณ์ หากอัลกอริทึมการทำลายน้ำให้ความสำคัญกับโทเคนเฉพาะเจาะจงเพื่อรักษาความต่อเนื่องของรูปแบบทางสถิติ มันอาจข้ามคำที่แม่นยำกว่าเพื่อเลือกคำที่ "ถูกต้อง" ทางสถิติแทนเพื่อรักษาลายน้ำไว้

Gruber เสนอว่าสิ่งนี้อาจนำไปสู่ความเสื่อมถอยของคุณภาพข้อความอย่างแนบเนียน โดยตั้งข้อสังเกตว่าเกณฑ์มาตรฐานที่ใช้ตรวจสอบระบบอย่าง SynthID ในปัจจุบัน เช่น การให้คะแนน "ถูกใจ/ไม่ถูกใจ" (thumbs-up/down) ของผู้ใช้นั้นยังไม่เพียงพอ ผู้ใช้ไม่น่าจะตำหนิโมเดลจากการเลือกคำว่า "grey" แทนที่จะเป็น "overcast" แม้ว่าคำหลังจะให้ความลึกซึ้งทางสไตล์ที่ดีกว่าก็ตาม ซึ่งหมายความว่า "คุณภาพ" ของข้อความอาจลดลงในรูปแบบที่เกณฑ์มาตรฐานทั่วไปไม่สามารถตรวจพบได้

นัยทางกฎหมายและลักษณะที่ "ติดสอยห้อยตาม" ของเครื่องหมาย

การเปิดตัวนี้สร้างความซับซ้อนอย่างมากสำหรับภาควิชาชีพ โดยเฉพาะด้านกฎหมาย ตามรายงานจาก Artificial Lawyer แม้ว่าลูกค้าส่วนใหญ่จะไม่ใส่ใจกับการใช้ AI ช่วยเหลือ แต่ความสามารถในการพิสูจน์การมีส่วนร่วมของ AI จะกลายเป็นความรับผิดชอบทางกฎหมาย (liability) ในกรณีที่การใช้ AI ถูกสั่งห้ามโดยผู้พิพากษาหรือลูกความอย่างชัดเจน

ความท้าทายทางเทคนิคที่สำคัญคือ "ความคงทน" (persistence) ของลายน้ำเหล่านี้ เนื่องจากเครื่องหมายถูกฝังอยู่ในตัวข้อความเอง มันจึงสามารถแพร่กระจายผ่านเอกสารต่างๆ ได้ สัญญาที่ร่างโดยมนุษย์ซึ่งมีข้อกำหนดที่สร้างโดย AI จะนำลายน้ำนั้นติดต่อไปด้วย ซึ่งอาจปนเปื้อนไปยังเทมเพลตในอนาคต นอกจากนี้ เมื่อนักกฎหมายใช้ LLM หลายตัว เอกสารอาจมีลายน้ำที่ซ้อนทับกันจากผู้ให้บริการหลายรายในที่สุด ซึ่งจะกลายเป็นฝันร้ายทางนิติวิทยาศาสตร์สำหรับการตรวจสอบความโปร่งใส

การปฏิบัติตามกฎระเบียบและการหลบเลี่ยง

การเคลื่อนไหวครั้งนี้ขับเคลื่อนโดยความจำเป็นในการปฏิบัติตามกฎหมาย AI ของสหภาพยุโรป (EU AI Act) แม้ว่า Anthropic จะนำฟีเจอร์นี้มาใช้ทั่วโลกเพื่อหลีกเลี่ยงความแตกแยกในแต่ละภูมิภาค โมเดล Claude ทั้งหมดที่ปล่อยออกมาหลังวันที่ 2 สิงหาคม รองรับการทำลายน้ำแล้ว โดยโมเดลรุ่นเก่ามีกำหนดการที่จะได้รับการปรับปรุงย้อนหลัง อย่างไรก็ตาม ประสิทธิภาพของระบบยังคงเป็นที่ถกเถียง เนื่องจากเครื่องมืออย่าง Declaude ถูกนำมาใช้เพื่อลบลายน้ำเหล่านี้ออกผ่านการถอดความ (paraphrasing) ซึ่งบ่งชี้ว่าแม้การทำลายน้ำอาจตอบสนองความต้องการของผู้ควบคุมกฎระเบียบได้ แต่อาจประสบปัญหาในการหยุดยั้งการหลบเลี่ยงอย่างจงใจ

สรุปประเด็นสำคัญ

  • การตรวจจับทางความน่าจะเป็น: Anthropic ใช้วิธีการรูปแบบเดียวกับ SynthID ที่เปลี่ยนความสุ่มในการเลือกโทเคนแทนการเพิ่มตัวอักษรที่มองเห็นได้ ทำให้ลายน้ำสามารถตรวจจับได้ทางสถิติแต่ถูกซ่อนไว้ทางสายตา
  • การแลกเปลี่ยนด้านคุณภาพ: นักวิจารณ์โต้แย้งว่าการบังคับให้เลือกคำเฉพาะเจาะจงเพื่อรักษาลวดลายของลายน้ำนั้น เป็นการสละความแม่นยำทางอรรถศาสตร์และความละเอียดอ่อนทางสไตล์โดยธรรมชาติ
  • ความรับผิดทางกฎหมาย: ลักษณะที่ "ติดสอยห้อยตาม" ของลายน้ำหมายความว่าข้อความที่สร้างโดย AI สามารถนำรูปแบบที่ตรวจจับได้ติดไปยังเอกสารในอนาคต ซึ่งสร้างความเสี่ยงด้านความโปร่งใสให้กับสำนักงานกฎหมายและอุตสาหกรรมที่มีการควบคุมอย่างเข้มงวด