Anthropic gần đây đã thông báo rằng các mẫu Claude mới sẽ bổ sung các hình mờ vô hình, có thể đọc được bằng máy vào văn bản do AI tạo ra và siêu dữ liệu nguồn gốc vào hình ảnh được tạo ra.
Điều này diễn ra khi các yêu cầu về tính minh bạch của Đạo luật AI của EU có hiệu lực vào ngày 2 tháng 8 năm 2026. Theo Điều 50 của Đạo luật, các nhà cung cấp hệ thống tạo ra hoặc thao tác nội dung tổng hợp phải đảm bảo đầu ra của họ được đánh dấu ở định dạng có thể đọc được bằng máy để cho phép phát hiện việc tạo ra hoặc thao tác nhân tạo.
Để đáp ứng yêu cầu này, Anthropic và các công ty AI lớn khác sử dụng sự kết hợp giữa các dấu bản quyền thống kê không thể nhận biết và chứng chỉ nội dung C2PA để ghi lại thông tin nguồn gốc của các tệp được tạo ra.
Điều này có nghĩa là không phải mỗi từ đều chứa một “mã Claude” riêng. Cơ chế hoạt động dựa trên đặc điểm thống kê của cả chuỗi văn bản. Vì vậy, bạn không thể mở Word, Google Docs hoặc một trình soạn thảo văn bản rồi nhìn thấy một dấu watermark nào đó trong từng câu.
Một điểm rất quan trọng đối với người sáng tạo nội dung là watermark AI không đồng nghĩa với bản quyền của Anthropic. Nếu bạn sử dụng Claude để hỗ trợ viết một bài blog, kịch bản YouTube, nội dung quảng cáo hoặc tài liệu đào tạo, việc văn bản có tín hiệu watermark không có nghĩa là Anthropic trở thành chủ sở hữu bản quyền của nội dung đó. Watermark nhằm phục vụ việc xác định nguồn gốc AI, chứ không phải là tuyên bố “Copyright © Anthropic”.
Cũng không nên hiểu rằng nếu một văn bản bị phát hiện có watermark Claude thì 100% nội dung đều do AI viết. Ví dụ, bạn có thể tự viết một bài 5.000 từ rồi đưa toàn bộ bài cho Claude để sửa lỗi chính tả, cải thiện câu văn hoặc tổ chức lại đoạn văn. Phần nội dung sau khi Claude xử lý có thể mang dấu hiệu liên quan đến Claude, nhưng điều đó không cho biết chính xác bao nhiêu phần trăm nội dung ban đầu là do con người tạo ra.
Đây là điểm đặc biệt quan trọng đối với nhà văn, giảng viên, nhà nghiên cứu, người làm marketing và các nhà sáng tạo nội dung. Việc sử dụng AI để chỉnh sửa một sản phẩm do con người tạo ra khác hoàn toàn với việc yêu cầu AI tạo toàn bộ sản phẩm. Một hệ thống phát hiện watermark về bản chất chỉ có thể cung cấp tín hiệu về sự tham gia của AI, chứ không thể tự mình xác định mức độ đóng góp của con người và AI.
Với hình ảnh và một số loại file, cách tiếp cận có thể khác. Anthropic có thể sử dụng C2PA Content Credentials, tức thông tin nguồn gốc được gắn vào file theo một tiêu chuẩn provenance có chữ ký kỹ thuật số. Cơ chế này giống như một “hộ chiếu nguồn gốc” cho nội dung số, cho phép các phần mềm tương thích kiểm tra thông tin về quá trình tạo hoặc chỉnh sửa nội dung.
C2PA khác với watermark văn bản. Watermark văn bản dựa vào đặc điểm thống kê của chính nội dung được tạo ra, trong khi C2PA dựa vào metadata và chữ ký mật mã được gắn với file. Vì vậy, nếu một hình ảnh được xuất sang định dạng khác, chụp màn hình hoặc xử lý bằng phần mềm không bảo toàn metadata, thông tin provenance có thể bị mất.
Đối với người sáng tạo nội dung, điều quan trọng nhất là hiểu rằng watermark không phải một “con dấu không thể phá bỏ”. Văn bản bị chỉnh sửa mạnh, paraphrase, dịch sang ngôn ngữ khác hoặc trộn với nội dung do con người viết có thể làm tín hiệu watermark yếu đi hoặc khó phát hiện hơn. Ngược lại, việc không phát hiện được watermark cũng không chứng minh rằng nội dung chắc chắn do con người viết.
Vì vậy, không nên sử dụng watermark của Claude như một AI detector tuyệt đối. Một hệ thống có thể nói rằng văn bản có tín hiệu phù hợp với Claude, nhưng điều đó không đồng nghĩa với kết luận pháp lý hay học thuật rằng “tác giả không phải con người”. Đây là hai vấn đề hoàn toàn khác nhau.
Đối với người sáng tạo nội dung, có thể hình dung toàn bộ quá trình như sau: bạn tạo nội dung → Claude hỗ trợ tạo hoặc chỉnh sửa → Claude tạo ra tín hiệu provenance → nội dung được xuất bản → hệ thống phát hiện có thể kiểm tra tín hiệu đó. Mục tiêu chính là tăng khả năng truy xuất nguồn gốc nội dung trong một môi trường mà ngày càng nhiều sản phẩm được tạo ra với sự hỗ trợ của AI.
Điều này cũng cho thấy một xu hướng lớn của ngành AI: trong tương lai, câu hỏi có thể không còn đơn giản là “Nội dung này có phải do AI tạo không?”, mà sẽ chuyển thành “AI đã tham gia vào quá trình tạo nội dung ở mức độ nào và nguồn gốc của nội dung có thể được xác minh như thế nào?”
Đối với người sáng tạo, đây là sự khác biệt rất đáng lưu ý. AI có thể là người tạo ý tưởng, viết bản nháp, biên tập, dịch, kiểm tra hoặc hoàn thiện nội dung. Vì vậy, việc xác định AI có tham gia hay không chỉ là một phần của câu chuyện. Quan trọng hơn là phải hiểu vai trò của con người, mức độ chỉnh sửa và quá trình hình thành sản phẩm cuối cùng.
Nói ngắn gọn, Anthropic không đơn giản “đóng dấu bản quyền của mình” lên nội dung bạn tạo bằng Claude. Họ đang xây dựng các cơ chế để nhận diện nguồn gốc AI, trong đó văn bản có thể sử dụng watermark thống kê còn một số loại file có thể sử dụng C2PA. Với người sáng tạo nội dung, điều này có nghĩa là việc sử dụng AI ngày càng có khả năng để lại dấu vết về nguồn gốc, nhưng dấu vết đó không tự động xác định quyền sở hữu, tác giả hay tỷ lệ đóng góp của AI trong sản phẩm cuối cùng.
Dùng Kỹ năng tác nhân + dịch vụ Python thư viện chuẩn để loại bỏ các dấu hiệu nguồn gốc AI đa nhà cung cấp khỏi văn bản và tệp tin — nhằm bảo vệ quyền riêng tư và tính toàn vẹn của nội dung bạn sở hữu. //github.com/guillaumemeyer/watermarks-remover

Bài viết liên quan: