Tạo dấu vân tay từ cách lựa chọn từ ngữ
Công nghệ thủy ấn văn bản của Anthropic dựa trên phương pháp SynthID-Text, do Google DeepMind phát triển và công bố trên tạp chí Nature năm 2024. Thay vì chèn ký tự hoặc dấu hiệu đặc biệt vào văn bản sau khi hoàn tất, phương pháp này can thiệp ngay trong quá trình mô hình ngôn ngữ lớn (LLM) dự đoán và lựa chọn token tiếp theo dựa trên ngữ cảnh trước đó.
Khi Claude có nhiều lựa chọn từ ngữ với ý nghĩa tương đương, hệ thống có thể sử dụng một khóa bí mật kết hợp với chuỗi token đã xuất hiện để đưa ra lựa chọn. Qua đó, một mẫu thống kê đặc trưng được hình thành trong quá trình tạo văn bản.
![]() |
| Anthropic đưa thủy ấn ẩn vào văn bản Claude để xác thực nội dung AI |
Với người đọc, nội dung vẫn hiển thị tự nhiên và không xuất hiện dấu hiệu đặc biệt. Trong khi đó, đơn vị nắm giữ cơ chế xác thực có thể phân tích chuỗi lựa chọn từ ngữ và tính toán xác suất thống kê để đánh giá khả năng văn bản được tạo bởi Claude.
Do dấu hiệu được tạo ngay trong quá trình sinh văn bản, phương pháp này không cần bổ sung nội dung hoặc ký tự vào câu trả lời. Anthropic kỳ vọng công nghệ sẽ hỗ trợ các tổ chức nhận diện nguồn gốc nội dung AI mà không làm thay đổi trải nghiệm đọc.
Tuy nhiên, hiệu quả của thủy ấn phụ thuộc vào đặc điểm văn bản. Với những nội dung quá ngắn, lượng dữ liệu có thể không đủ để tạo mẫu thống kê đáng tin cậy. Công nghệ cũng gặp hạn chế với những nội dung có tính chính xác cố định, chẳng hạn mã nguồn hoặc dữ liệu kỹ thuật, khi mô hình có rất ít lựa chọn về cách diễn đạt.
Một trường hợp khác là văn bản có sẵn được người dùng yêu cầu Claude chỉnh sửa. Nếu Claude chỉ sửa lỗi chính tả, ngữ pháp hoặc dấu câu trên nội dung do con người viết, cơ chế thủy ấn không nhất thiết có thể xác định văn bản đó là sản phẩm được Claude tạo ra.
Dấu hiệu này cũng chỉ hỗ trợ xác định khả năng Claude tham gia vào quá trình tạo nội dung, chứ không cho biết mô hình tạo toàn bộ văn bản hay chỉ tham gia ở một khâu biên tập. Nếu nội dung bị con người hoặc hệ thống AI khác viết lại đáng kể, dấu hiệu thống kê ban đầu có thể bị suy giảm hoặc mất đi.
Mở rộng xác thực qua API và C2PA
Anthropic dự kiến phát hành API riêng để các tổ chức và nhà phát triển có thể kiểm tra, xác thực dấu thủy ấn trong văn bản. Việc triển khai được đặt trong bối cảnh các yêu cầu về minh bạch và xác định nội dung do AI tạo ra ngày càng được chú trọng, trong đó có các quy định liên quan đến AI tại Liên minh châu Âu (EU). Theo kế hoạch, công nghệ được áp dụng trên phạm vi toàn cầu do những hạn chế kỹ thuật trong việc phân vùng tính năng theo từng khu vực.
Bên cạnh văn bản, Anthropic sử dụng C2PA đối với các tệp hình ảnh do Claude xử lý hoặc tạo ra, gồm PNG, JPG và SVG. Thông tin xác thực được gắn với tệp thông qua metadata, cung cấp thêm dữ liệu về nguồn gốc và quá trình xử lý nội dung. C2PA là tiêu chuẩn xác thực nguồn gốc và lịch sử nội dung số, khác với cơ chế thủy ấn thống kê được sử dụng đối với văn bản.
Anthropic cũng cho biết sẽ tiếp tục bổ sung công nghệ thủy ấn cho các mô hình AI thuộc phạm vi kế hoạch cập nhật của công ty. Dù có thể hỗ trợ xác thực nguồn gốc nội dung, thủy ấn ẩn vẫn phụ thuộc vào độ dài, đặc điểm văn bản và mức độ chỉnh sửa sau khi được tạo. Vì vậy, công nghệ này được xem là một công cụ hỗ trợ xác thực, thay vì phương thức có thể nhận diện tuyệt đối mọi nội dung do AI tạo ra.