Anthropic เผยวิธีการทำงาน "ระบบฝังลายน้ำ" ในข้อความจาก Claude

Anthropic เผยวิธีการทำงาน ระบบฝังลายน้ำ ในข้อความจาก Claude ผ่านรูปแบบการเลือกคำที่ผู้อ่านมองไม่เห็น พร้อมเตรียมเปิด API สำหรับตรวจสอบ

Anthropic เปิดเผยรายละเอียดเพิ่มเติม เกี่ยวกับระบบลายน้ำ (Watermarks)ในข้อความที่สร้างโดย Claude รุ่นใหม่ ซึ่ง Anthropic ระบุว่า “เป็นการเปลี่ยนแปลงเพื่อให้สอดคล้องกับข้อกำหนดด้านความโปร่งใสของ EU AI Act”

ระบบจะสร้างลายน้ำด้วยการปรับวิธีที่ Claude เลือกใช้คำ ซึ่งมีความหมายเหมาะสมใกล้เคียงกันอย่างละเอียด เช่น เลือกใช้คำว่า “overcast” แทน “grey” เมื่อต้องบรรยายสภาพอากาศ

รูปแบบที่เกิดขึ้นจะไม่สามารถสังเกตได้ด้วยการอ่านตามปกติ แต่ผู้ที่มีคีย์ที่เหมาะสมจะสามารถประเมินความเป็นไปได้ว่า Claude เคยสร้างหรือประมวลผลข้อความนั้นหรือไม่ นอกจากนี้ Anthropic ยังมีแผนเปิดตัว API สำหรับตรวจจับลายน้ำด้วย

ไม่เพิ่มอักขระซ่อนหรือข้อมูลระบุตัวผู้ใช้

Anthropic เปิดเผยรายละเอียดครั้งนี้หลังจากประกาศเรื่องข้อกำหนดลายน้ำก่อนหน้านี้ และทำให้เกิดการถกเถียงในกลุ่มผู้ใช้ Claude

Anthropic ระบุว่าวิธีดังกล่าว “แทบไม่ส่งผลต่อคุณภาพของคำตอบ” ไม่มีการเพิ่มอักขระที่ซ่อนอยู่ ไม่ต้องใช้ Token เพิ่ม และไม่มีข้อมูลระบุตัวตนที่สามารถเชื่อมโยงกลับไปยังผู้ใช้ องค์กร หรือบทสนทนาใดบทสนทนาหนึ่งได้

Claude ใช้เทคนิค SynthID-Text เวอร์ชันหนึ่ง ซึ่ง Google DeepMind เผยแพร่ผ่านวารสาร Nature ในปี 2024 โดยเทคนิคนี้ แทบไม่กระทบต่อความเร็ว และไม่ทำให้ต้นทุนเพิ่มขึ้น

วิธีดังกล่าวแตกต่างจากซอฟต์แวร์ตรวจจับ AI แบบดั้งเดิมที่วิเคราะห์รูปแบบการเขียน เพราะระบบของ Anthropic จะตรวจหารูปแบบที่เข้ารหัสไว้ด้วยคีย์โดยเฉพาะ

Anthropic ยังระบุว่า ผู้พัฒนาโมเดลรายใหญ่อื่น ๆ ที่ลงนามใน EU Code of Practice จะนำระบบลายน้ำของตนเองมาใช้เช่นกัน

ตรวจจับได้แม่นยำขึ้นเมื่อข้อความมีความยาว

ระบบลายน้ำจะทำงานได้ดีที่สุดกับข้อความที่มีความยาว เนื่องจาก Claude มีโอกาสเลือกใช้คำต่าง ๆ ตามดุลยพินิจของโมเดลมากขึ้น

การแก้ไขข้อความเพียงเล็กน้อยอาจไม่สามารถลบลายน้ำออกได้ทั้งหมด แต่การเขียนเนื้อหาใหม่โดยเปลี่ยนทุกคำจะทำให้ลายน้ำหายไป

อย่างไรก็ตาม Anthropic ย้ำว่า ระบบทำได้เพียงประเมินว่า Claude อาจมีส่วนในการสร้างหรือแก้ไขข้อความเท่านั้น ไม่สามารถใช้เป็นหลักฐานยืนยันผู้เขียน หรือแยกระหว่างข้อความที่ AI สร้างทั้งหมดกับข้อความที่ AI นำมาแก้ไขอย่างมากได้

หาก Claude ทำหน้าที่เพียงตรวจทานหรือแก้ไขงานเขียนของมนุษย์เล็กน้อย ข้อความอาจมีคำที่ Claude เป็นผู้เลือกไม่มากพอสำหรับการตรวจจับอย่างน่าเชื่อถือ

โค้ดมีลายน้ำน้อยกว่าข้อความทั่วไป

โค้ดจะมีลายน้ำน้อยกว่าเนื้อหาประเภทอื่น เนื่องจากโมเดลมีโอกาสเลือกใช้คำหรือรูปแบบอื่นที่ถูกต้องเท่าเทียมกันน้อยกว่า อย่างไรก็ตาม ความคิดเห็นในโค้ดและข้อความส่วนอื่นที่โมเดลสามารถเลือกถ้อยคำได้ยังอาจมีลายน้ำอยู่

ข้อความแปลที่สร้างโดย Claude จะมีลายน้ำเช่นกัน เพราะทุกคำในการแปลถูกเลือกโดยโมเดล

สำหรับรูปภาพและไฟล์ประเภทอื่นที่รองรับ Claude จะใช้วิธีแนบข้อมูลรับรองเนื้อหา C2PA ไว้ใน Metadata ของไฟล์แทน

Anthropic จะใช้ระบบดังกล่าวกับผู้ใช้ทั่วโลก เนื่องจากบริษัทยังไม่มีวิธีที่รองรับในระยะยาวสำหรับจำกัดการฝังลายน้ำตามภูมิภาค ส่วน Claude รุ่นเก่าจะทยอยได้รับระบบลายน้ำในช่วงหลายเดือนข้างหน้า ซึ่งเป็นส่วนหนึ่งของช่วงเปลี่ยนผ่านตาม EU AI Act

ที่มา: iClarified