Cuộc sống số

'Anthropic dùng búa tạ với watermark AI, dù EU chỉ yêu cầu dao mổ'

Sơn Vân 22/08/2026 06:00

Từ ngày 2/8, Anthropic đã nhúng watermark vô hình vào văn bản do Claude tạo ra hoặc xử lí. Liệu luật của Liên minh châu Âu (EU) có thực sự yêu cầu Anthropic phải áp dụng biện pháp mạnh tay đến vậy?

Tuần trước, Anthropic cho biết một số phiên bản Claude sẽ nhúng “watermark không thể nhận biết bằng mắt thường” trực tiếp vào nội dung văn bản. Watermark đó sẽ đi theo nội dung khi người dùng sao chép và dán, đồng thời có thể vẫn tồn tại sau một số thao tác chỉnh sửa.

Theo Anthropic, công nghệ này giúp phân biệt nội dung được Claude xử lí với văn bản do con người viết. Tuy nhiên, watermark này không chứng minh Claude là tác giả của toàn bộ nội dung.

Trong lĩnh vực công nghệ và AI, watermark là dấu hiệu được nhúng vào nội dung kỹ thuật số để có thể xác định nguồn gốc hoặc nhận biết nội dung đó do mô hình AI nào tạo ra. Watermark này có thể hiển thị rõ ràng hoặc ẩn mà không thể nhận biết bằng mắt thường.

Các mô hình Claude được phát hành từ ngày 2/8 đã áp dụng watermark. Anthropic lên kế hoạch bổ sung watermark cho các mô hình AI cũ trong những tháng tới.

Anthropic khẳng định watermark không làm thay đổi ý nghĩa, chất lượng hay khả năng đọc hiểu câu trả lời của Claude. Tuy nhiên, nhiều người đã đăng bài trên mạng xã hội X cho biết hủy thuê bao Claude vì không đồng tình với việc Anthropic nhúng watermark.

Anthropic cho biết công ty bổ sung watermark nhằm tuân thủ Đạo luật AI của EU. Anthropic cũng dự định phát hành miễn phí API (giao diện lập trình ứng dụng), cho phép người dùng và bên thứ ba tự kiểm tra xem một đoạn văn bản có watermark của Claude hay không.

Công ty AI hàng đầu Mỹ áp dụng watermark trên toàn cầu vì chưa có giải pháp kỹ thuật để triển khai riêng biệt theo từng khu vực.

Anthropic dùng búa tạ với watermark AI, dù EU chỉ yêu cầu dao mổ
Các mô hình Claude được phát hành từ ngày 2/8 đã áp dụng watermark vô hình vào văn bản. Ảnh: Getty Images

Một bài phân tích của trang Insider, dựa trên việc xem xét luật và phỏng vấn các chuyên gia về AI cũng như chính sách, cho thấy cách tiếp cận của Anthropic có thể vượt quá những gì EU yêu cầu.

"Anthropic đang sử dụng búa tạ, tác động cả đến những tác vụ đơn giản"

Theo Điều 50(2) trong Đạo luật AI của EU, các công ty AI không bắt buộc phải đánh dấu nội dung do AI tạo ra, nếu công nghệ chỉ được sử dụng cho những tác vụ chỉnh sửa thông thường hoặc không làm thay đổi đáng kể câu chữ hay ý nghĩa ban đầu của người dùng.

Watermark của Anthropic được thiết kế để vẫn có thể phát hiện sau khi văn bản được sao chép và dán sang nơi khác. Nó có thể xuất hiện trong bản dịch, bản tóm tắt và cả những văn bản đã được chỉnh sửa ở mức độ đáng kể.

“Về cơ bản, Điều 50 yêu cầu một con dao mổ để phát hiện deepfake và nội dung tổng hợp hàng loạt, nhưng Anthropic lại đang sử dụng chiếc búa tạ, tác động cả đến những tác vụ đơn giản như kiểm tra chính tả và dịch thuật”, Caroline De Cock, thành viên cấp cao tại tổ chức tư vấn Lisbon Council và người đứng đầu bộ phận nghiên cứu của Information Labs, nói với Insider.

Một số người hoan nghênh tính minh bạch mà watermark AI có thể mang lại. Tuy nhiên, thông báo của Anthropic cũng vấp phải làn sóng phản đối. Một số người dùng Claude cho biết đã hủy thuê bao, trong khi các nhà phát triển tạo ra công cụ mới để xóa watermark.

Một mối lo ngại thường xuyên được nhắc đến là watermark có thể bị hiểu là dấu hiệu cho thấy Claude đã viết ra văn bản, ngay cả khi người dùng chỉ sử dụng chatbot AI này để chỉnh sửa hoặc kiểm tra lỗi.

Điều đó xuất phát từ phương pháp kỹ thuật đằng sau watermark của Anthropic. Claude được định hướng lựa chọn từ ngữ theo một cách nhất định, tạo ra một dấu hiệu có thể nhận biết, qua đó cho thấy chatbot nhiều khả năng đã tham gia viết văn bản.

Một người phát ngôn của Anthropic nói với Insider rằng những lần chỉnh sửa văn bản ở mức nhẹ bằng Claude ít có khả năng tạo ra watermark, vì trong trường hợp này “hầu như không có nội dung nào để watermark bám vào”.

Milos Rusic, đồng sáng lập kiêm giám đốc điều hành công ty AI dành cho doanh nghiệp Deepset, nói với Insider rằng: “Anthropic đang áp dụng cách diễn giải có phần rộng hơn so với quy định của luật EU”. Theo ông, cách Claude chọn từ có thể để lại dấu hiệu cho thấy đã tham gia vào quá trình tạo văn bản, ngay cả khi ý tưởng hoặc tài liệu ban đầu không phải do chatbot AI của Anthropic tạo ra.

Vì sao Anthropic lại chọn cách tiếp cận này?

Theo Caroline De Cock, cách làm đó phù hợp với “bản sắc thương hiệu của Anthropic với tư cách một nhà phát triển AI đặt an toàn lên hàng đầu”.

Bà cũng cho rằng cách này có thể giúp Anthropic giảm rủi ro pháp lý bằng cách “chuyển hoàn toàn trách nhiệm lọc và diễn giải các nhãn đó sang người dùng cuối và các nền tảng bên ngoài”.

Một người phát ngôn Anthropic cho biết công ty sẽ “tiếp tục đánh giá các phương pháp khác nhau”.

Google, Meta, xAI nói gì về watermark AI?

Các quy định của EU về watermark áp dụng với những mô hình AI mới được ra mắt tại châu Âu từ ngày 2/8 trở đi. Các mô hình AI cũ hơn được chuyển tiếp thời gian tuân thủ đến 2/12.

Điều đó đồng nghĩa các hãng công nghệ khác hoạt động tại châu Âu sẽ phải triển khai các phương thức để đánh dấu và phát hiện nội dung do AI tạo ra trong những tháng tới.

Một số công ty đã có công nghệ này.

Google cho biết đã sử dụng công nghệ SynthID để tạo watermark vô hình cho văn bản, hình ảnh, âm thanh và video do các mô hình AI của hãng tạo ra trên toàn cầu.

OpenAI thông báo có kế hoạch mở rộng việc gắn nhãn sang văn bản, nhưng chưa đưa ra thời điểm cụ thể.

Trong khi đó, Meta hồi tháng 7 đã tiết lộ về nỗ lực phát triển các công cụ thiết thực, có khả năng tương thích cao để nhận diện nội dung do AI tạo ra. Đến nay, Meta chủ yếu tập trung vào hình ảnh và chưa công bố chi tiết về kế hoạch nhúng watermark vào văn bản.

xAI đã gắn nhãn AI cho một số nội dung, trong đó có thông báo rời nhiệm sở gần đây của Thư ký báo chí Nhà Trắng Karoline Leavitt trên X. Tuy nhiên, nhãn này sau đó đã biến mất.

Làn sóng watermark sắp tới diễn ra trong bối cảnh nhiều công ty đang khuyến khích nhân viên sử dụng AI. Giờ đây, một số người lo ngại việc sử dụng AI có thể bị phát hiện, từ đó khiến quyền tác giả với công việc của họ bị đặt dấu hỏi.

"Các hệ thống này có thể cung cấp bằng chứng hữu ích, nhưng tôi sẽ rất thận trọng khi biến chúng thành cơ sở để tự động đưa ra phán xét về quyền tác giả hay các hành vi sai phạm", Milos Rusic nhận định về watermark AI.

Sơn Vân