Cuộc sống số

Anthropic nhúng watermark vào văn bản do Claude tạo ra

Hà Minh 12/08/2026 09:52

Anthropic bắt đầu nhúng dấu hiệu nhận diện không thể nhìn thấy vào văn bản do các phiên bản Claude mới tạo ra, nhằm tăng khả năng truy xuất nguồn gốc nội dung AI và đáp ứng các yêu cầu về minh bạch theo Đạo luật AI của Liên minh châu Âu.

Anthropic cho biết các mô hình Claude được phát hành từ ngày 2/8 sẽ được tích hợp một dạng hình mờ (watermark) vô hình trong văn bản do AI tạo ra. Công nghệ này không làm thay đổi nội dung hoặc ý nghĩa của văn bản, đồng thời dấu hiệu nhận diện có thể vẫn tồn tại sau một số thao tác chỉnh sửa, sao chép và dán.

anthropic-to-introduce-invisible-watermarks-on-ai-text-in-v0-izjgn9juughzifilxxssgdedk-fpjak6xdy4cdur150.webp
Anthropic nhúng watermark vào văn bản do Claude tạo ra

Đáng chú ý, dù động thái được Anthropic giới thiệu trong bối cảnh Liên minh châu Âu tăng cường yêu cầu về tính minh bạch đối với nội dung do AI tạo ra, cơ chế này sẽ được triển khai trên phạm vi toàn cầu đối với các mẫu Claude mới.

Theo Anthropic, dấu hiệu nhận diện nhằm cung cấp thêm thông tin về nguồn gốc của nội dung trong bối cảnh văn bản do AI tạo ra ngày càng phổ biến. Công ty cũng đang hướng tới việc tích hợp các dấu hiệu có thể được máy tính đọc và nhận biết, qua đó hỗ trợ quá trình xác định liệu một nội dung có từng được xử lý bởi Claude hay không.

Không chỉ áp dụng với văn bản, Anthropic cho biết các tệp được Claude tạo ra cũng có thể được bổ sung siêu dữ liệu nguồn gốc có chữ ký. Công ty đang nghiên cứu mở rộng cơ chế này sang các phiên bản Claude cũ hơn và dự kiến cung cấp công cụ để người dùng có thể kiểm tra các dấu hiệu nhận diện.

Tuy nhiên, Anthropic nhấn mạnh đây không phải một phương thức xác thực tuyệt đối về tác giả của nội dung.

Việc phát hiện dấu hiệu nhận diện chỉ cho thấy nội dung có khả năng đã được Claude xử lý. Chẳng hạn, một văn bản do con người viết nhưng được đưa vào Claude để hiệu đính hoặc dịch thuật cũng có thể xuất hiện dấu hiệu này. Ngược lại, việc không phát hiện dấu hiệu không đồng nghĩa văn bản chắc chắn không được tạo bởi Claude, bởi quá trình chỉnh sửa, diễn giải, dịch thuật nhiều lần hoặc kết hợp với nội dung từ các nguồn khác có thể làm mất tín hiệu.

Cách tiếp cận này cho thấy các hãng AI đang chuyển từ việc chỉ tập trung phát triển mô hình sang xây dựng thêm cơ chế truy xuất nguồn gốc và minh bạch hóa nội dung do AI tạo ra. Đây là vấn đề ngày càng đáng chú ý khi nội dung sinh bởi AI được sử dụng rộng rãi trong xuất bản, truyền thông, giáo dục và hoạt động sáng tạo.

Anthropic không phải công ty đầu tiên nghiên cứu công nghệ đánh dấu nội dung AI. Google DeepMind trước đó đã phát triển SynthID, một hệ thống đánh dấu nội dung do AI tạo ra, trong đó có các giải pháp dành cho văn bản và video.

Điểm khác biệt trong cách tiếp cận của Anthropic là dấu hiệu nhận diện được thiết kế để không thể nhận biết bằng mắt thường, nhưng có khả năng được phát hiện bằng các công cụ phù hợp. Điều này có thể tạo thêm một lớp thông tin phục vụ việc kiểm tra nguồn gốc nội dung mà không làm thay đổi trải nghiệm đọc của người dùng.

Trong thực tế, công nghệ watermark đối với văn bản AI vẫn phải đối mặt với bài toán khó: làm thế nào để tín hiệu đủ bền vững trước các thao tác chỉnh sửa nhưng không gây ảnh hưởng đến chất lượng và tính tự nhiên của văn bản. Chính Anthropic cũng thừa nhận những giới hạn này và không coi watermark là bằng chứng duy nhất để kết luận một nội dung do AI tạo ra.

Với việc đưa cơ chế nhận diện vào các phiên bản Claude mới trên toàn cầu, Anthropic đang đặt thêm một lớp kỹ thuật vào quy trình tạo và sử dụng nội dung AI. Nếu các công cụ phát hiện được phát triển tương ứng, người dùng và các nền tảng có thể có thêm dữ liệu để đánh giá nguồn gốc nội dung, thay vì chỉ dựa vào các công cụ đoán văn bản do AI tạo ra vốn thường cho kết quả không chắc chắn.

Nổi bật
      Mới nhất
      Anthropic nhúng watermark vào văn bản do Claude tạo ra
      • Mặc định

      POWERED BY ONECMS - A PRODUCT OF NEKO