Khoa học - Công nghệ

Anthropic bắt đầu gắn dấu vân tay ngầm vào văn bản Claude nhằm minh bạch hóa nội dung do AI tạo ra

Vũ Sơn17/08/2026 13:59

Anthropic chuẩn bị triển khai công nghệ watermark ngầm cho văn bản từ Claude nhằm tuân thủ Đạo luật AI của EU mà không làm ảnh hưởng đến tốc độ hay chi phí.

Anthropic vừa tuyên bố chuẩn bị áp dụng công nghệ gắn hình mờ (watermark) ngầm cho các văn bản do các mô hình trí tuệ nhân tạo Claude khởi tạo. Giải pháp mới cho phép nhận diện dấu vết sáng tạo của AI mà hoàn toàn không chèn ký tự ẩn, không làm thay đổi nội dung hay gây ra sự đứt gãy trong quá trình đọc, nhằm nâng cao tính minh bạch mà không đánh đổi trải nghiệm người dùng.

Cơ chế ẩn đằng sau dấu vân tay ngầm của AI

Điểm đặc biệt của công nghệ này nằm ở chỗ watermark không sử dụng thêm bất kỳ token nào trong câu trả lời, từ đó đảm bảo không ảnh hưởng đến tốc độ phản hồi cũng như không gia tăng chi phí cho người dùng Claude. Anthropic triển khai bước đi này nhằm đáp ứng Đạo luật AI của Liên minh châu Âu (EU), nối tiếp việc công ty cùng khoảng 190 đơn vị khác ký Bộ quy tắc thực hành về tính minh bạch nội dung AI hồi tháng 7. Tính năng này sẽ được áp dụng trên phạm vi toàn cầu do doanh nghiệp chưa có phương án giới hạn theo từng khu vực.

Thêm một công ty AI đạt lợi nhuận kỷ lục
Ảnh minh họa.

Về mặt vận hành kỹ thuật, cơ chế này khai thác trực tiếp quá trình mô hình ngôn ngữ chọn từ tiếp theo dựa trên bối cảnh phía trước. Trong các trường hợp Claude có nhiều phương án từ ngữ tương đồng để lựa chọn mà không làm biến đổi ý nghĩa câu, hệ thống sẽ sử dụng một khóa kết hợp với các từ xuất hiện trước đó để đưa ra quyết định, thay vì chọn ngẫu nhiên.

Quá trình này tạo nên một mẫu thống kê xuyên suốt toàn bộ văn bản. Độc giả thông thường sẽ không thể nhận ra sự khác biệt, nhưng chủ sở hữu khóa có thể quét chuỗi lựa chọn để tính toán xác suất văn bản đó được tạo bởi Claude. Anthropic đã áp dụng một phiên bản phát triển từ phương pháp SynthID-Text do Google DeepMind công bố trên tạp chí Nature vào năm 2024. Kết quả thử nghiệm nội bộ cho thấy công nghệ không gây ảnh hưởng đáng kể tới chất lượng, độ sáng tạo hay tính dễ đọc của văn bản.

Những giới hạn kỹ thuật và lộ trình phủ sóng

Dù mang lại bước tiến lớn trong kiểm soát nội dung AI, Anthropic thẳng thắn thừa nhận công nghệ này vẫn tồn tại những rào cản kỹ thuật nhất định. Watermark sẽ hoạt động kém hiệu quả đối với các đoạn văn quá ngắn hoặc những nội dung đòi hỏi độ chính xác tuyệt đối như mã nguồn (code), dữ liệu chỉ có một đáp án đúng, hoặc trường hợp người dùng chỉ nhờ AI sửa lỗi chính tả, ngữ pháp và dấu câu trên văn bản có sẵn.

Bên cạnh đó, dấu hiệu ngầm này chỉ giúp xác định khả năng Claude từng tham gia tạo nội dung chứ không thể phân biệt mô hình viết toàn bộ hay chỉ biên tập, cũng như không định danh được nếu nội dung do con người hay một hệ thống AI khác tạo ra. Mặc dù bản dịch do Claude thực hiện vẫn giữ được watermark, nhưng nếu toàn bộ văn bản bị viết lại hoàn toàn và thay thế hết từ ngữ thì dấu vết này có thể bị loại bỏ.

Theo kế hoạch, Anthropic sẽ sớm phát hành API phục vụ việc kiểm tra watermark. Đối với các tệp hình ảnh như PNG, JPG hay SVG, Claude sử dụng phương thức gắn thông tin xác thực C2PA vào metadata của tệp để ghi nhận dấu vết xử lý. Công ty cũng khẳng định sẽ bổ sung công nghệ watermark cho các mô hình AI ra mắt trước ngày 2/8 trong các tháng sắp tới.

Vũ Sơn