
Claude, một trong những mô hình AI tiên tiến nhất hiện nay, sẽ bắt đầu áp dụng watermark cho văn bản mà nó tạo ra từ ngày 14 tháng 8 năm 2026. Việc này nhằm xác định khả năng văn bản đó có liên quan đến Claude hay không, đồng thời tuân thủ quy định của EU về AI. Theo thông báo từ Anthropic, công ty phát triển Claude, watermark không làm thay đổi chất lượng hay nội dung của văn bản mà Claude tạo ra.
Watermark là một phương pháp cho phép người dùng xác định liệu văn bản có được tạo ra bởi Claude hay không mà không làm ảnh hưởng đến trải nghiệm đọc. Các nhà phát triển cho biết sự khác biệt giữa văn bản có watermark và không có watermark sẽ không thể phân biệt được với người đọc. Không có ký tự ẩn nào được thêm vào văn bản, và watermark không yêu cầu thêm token, do đó không làm tăng chi phí sử dụng.
Cách thức hoạt động của watermark
Claude hoạt động bằng cách tạo ra từng từ một. Mỗi khi mô hình quyết định từ tiếp theo, nó chọn từ một danh sách các ứng viên tiềm năng, cuối cùng chọn từ hợp lý nhất dựa trên văn bản trước đó. Watermark sử dụng những lựa chọn không quan trọng trong quá trình này để tạo ra một mẫu trong các phản hồi của Claude. Mẫu này không thể phát hiện bởi người đọc, nhưng có thể được nhận diện bởi những người có chìa khóa mã hóa nó.
Khi watermark được sử dụng, các lựa chọn vẫn được thực hiện ngẫu nhiên, nhưng nguồn gốc của sự ngẫu nhiên này khác đi. Thay vì sử dụng một bộ sinh số ngẫu nhiên tùy ý, watermark sử dụng chìa khóa và một vài từ trước đó để quyết định từ mà mô hình nên chọn. Điều này cho phép xác định xác suất rằng văn bản được tạo ra bởi Claude.
Ảnh hưởng của watermark đến đầu ra của Claude
Theo các thử nghiệm nội bộ, watermark không ảnh hưởng đến chất lượng, mức độ sáng tạo hay khả năng đọc hiểu của văn bản do Claude tạo ra. Một nghiên cứu từ Google DeepMind cho thấy không có sự khác biệt đáng kể nào giữa mô hình có watermark và mô hình không có watermark khi so sánh đánh giá của người dùng.
Giới phân tích cho rằng watermark không làm chậm mô hình hay làm tăng chi phí sử dụng. Điều này có nghĩa là người dùng có thể tiếp tục sử dụng Claude mà không phải lo lắng về việc tăng chi phí hay giảm hiệu suất.
Động lực áp dụng watermark
Việc áp dụng watermark cho văn bản của Claude nhằm tuân thủ quy định của EU về AI. Anthropic cùng với nhiều nhà cung cấp mô hình AI khác đã ký vào Bộ quy tắc thực hành về tính minh bạch của nội dung do AI tạo ra vào tháng 7 năm 2026. Điều này yêu cầu các nhà cung cấp hệ thống AI phải sử dụng các phương pháp “đánh dấu” văn bản do AI tạo ra.
Watermark sẽ được áp dụng toàn cầu ngay từ khi ra mắt, mặc dù Anthropic sẽ tiếp tục đánh giá các phương pháp khác nhau và sẽ cập nhật thông tin khi có thêm thông tin.
Những câu hỏi thường gặp
- Watermark có thể được phát hiện không? Anthropic sẽ sớm cung cấp một API phát hiện watermark để người dùng có thể kiểm tra liệu một đoạn văn bản có được tạo ra bởi Claude hay không.
- Watermark có áp dụng cho các bản dịch không? Có, bản dịch được tạo ra bởi Claude cũng sẽ mang watermark.
- Watermark có thể bị xóa không? Một số chỉnh sửa nhẹ có thể không xóa hoàn toàn watermark, nhưng việc viết lại hoàn toàn sẽ xóa nó.
Như vậy, việc áp dụng watermark cho văn bản do Claude tạo ra không chỉ giúp xác định nguồn gốc của văn bản mà còn đảm bảo tính minh bạch và tuân thủ quy định pháp lý. Đây là một bước tiến quan trọng trong việc phát triển công nghệ AI và bảo vệ quyền lợi của người tiêu dùng.
TH (phapluatxahoi.kinhtedothi.vn)
