Thứ năm 01/10/2026 20:04
Hotline: 024.355.63.010
Email: banbientap.dnhn@gmail.com
Kinh tế số

Anthropic đưa thủy ấn ẩn vào văn bản Claude để xác thực nội dung AI

Anthropic triển khai công nghệ thủy ấn ẩn cho văn bản do Claude tạo ra, nhằm hỗ trợ xác thực nguồn gốc nội dung AI và tăng tính minh bạch.

Tạo dấu vân tay từ cách lựa chọn từ ngữ

Công nghệ thủy ấn văn bản của Anthropic dựa trên phương pháp SynthID-Text, do Google DeepMind phát triển và công bố trên tạp chí Nature năm 2024. Thay vì chèn ký tự hoặc dấu hiệu đặc biệt vào văn bản sau khi hoàn tất, phương pháp này can thiệp ngay trong quá trình mô hình ngôn ngữ lớn (LLM) dự đoán và lựa chọn token tiếp theo dựa trên ngữ cảnh trước đó.

Khi Claude có nhiều lựa chọn từ ngữ với ý nghĩa tương đương, hệ thống có thể sử dụng một khóa bí mật kết hợp với chuỗi token đã xuất hiện để đưa ra lựa chọn. Qua đó, một mẫu thống kê đặc trưng được hình thành trong quá trình tạo văn bản.

Anthropic đưa thủy ấn ẩn vào văn bản Claude để xác thực nội dung AI
Anthropic đưa thủy ấn ẩn vào văn bản Claude để xác thực nội dung AI

Với người đọc, nội dung vẫn hiển thị tự nhiên và không xuất hiện dấu hiệu đặc biệt. Trong khi đó, đơn vị nắm giữ cơ chế xác thực có thể phân tích chuỗi lựa chọn từ ngữ và tính toán xác suất thống kê để đánh giá khả năng văn bản được tạo bởi Claude.

Do dấu hiệu được tạo ngay trong quá trình sinh văn bản, phương pháp này không cần bổ sung nội dung hoặc ký tự vào câu trả lời. Anthropic kỳ vọng công nghệ sẽ hỗ trợ các tổ chức nhận diện nguồn gốc nội dung AI mà không làm thay đổi trải nghiệm đọc.

Tuy nhiên, hiệu quả của thủy ấn phụ thuộc vào đặc điểm văn bản. Với những nội dung quá ngắn, lượng dữ liệu có thể không đủ để tạo mẫu thống kê đáng tin cậy. Công nghệ cũng gặp hạn chế với những nội dung có tính chính xác cố định, chẳng hạn mã nguồn hoặc dữ liệu kỹ thuật, khi mô hình có rất ít lựa chọn về cách diễn đạt.

Một trường hợp khác là văn bản có sẵn được người dùng yêu cầu Claude chỉnh sửa. Nếu Claude chỉ sửa lỗi chính tả, ngữ pháp hoặc dấu câu trên nội dung do con người viết, cơ chế thủy ấn không nhất thiết có thể xác định văn bản đó là sản phẩm được Claude tạo ra.

Dấu hiệu này cũng chỉ hỗ trợ xác định khả năng Claude tham gia vào quá trình tạo nội dung, chứ không cho biết mô hình tạo toàn bộ văn bản hay chỉ tham gia ở một khâu biên tập. Nếu nội dung bị con người hoặc hệ thống AI khác viết lại đáng kể, dấu hiệu thống kê ban đầu có thể bị suy giảm hoặc mất đi.

Mở rộng xác thực qua API và C2PA

Anthropic dự kiến phát hành API riêng để các tổ chức và nhà phát triển có thể kiểm tra, xác thực dấu thủy ấn trong văn bản. Việc triển khai được đặt trong bối cảnh các yêu cầu về minh bạch và xác định nội dung do AI tạo ra ngày càng được chú trọng, trong đó có các quy định liên quan đến AI tại Liên minh châu Âu (EU). Theo kế hoạch, công nghệ được áp dụng trên phạm vi toàn cầu do những hạn chế kỹ thuật trong việc phân vùng tính năng theo từng khu vực.

Bên cạnh văn bản, Anthropic sử dụng C2PA đối với các tệp hình ảnh do Claude xử lý hoặc tạo ra, gồm PNG, JPG và SVG. Thông tin xác thực được gắn với tệp thông qua metadata, cung cấp thêm dữ liệu về nguồn gốc và quá trình xử lý nội dung. C2PA là tiêu chuẩn xác thực nguồn gốc và lịch sử nội dung số, khác với cơ chế thủy ấn thống kê được sử dụng đối với văn bản.

Anthropic cũng cho biết sẽ tiếp tục bổ sung công nghệ thủy ấn cho các mô hình AI thuộc phạm vi kế hoạch cập nhật của công ty. Dù có thể hỗ trợ xác thực nguồn gốc nội dung, thủy ấn ẩn vẫn phụ thuộc vào độ dài, đặc điểm văn bản và mức độ chỉnh sửa sau khi được tạo. Vì vậy, công nghệ này được xem là một công cụ hỗ trợ xác thực, thay vì phương thức có thể nhận diện tuyệt đối mọi nội dung do AI tạo ra.

Tin bài khác
AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

AI, Deepfake mở mặt trận mới trong cuộc chiến chống gian lận tài chính

Sự phát triển của AI, Deepfake, DeepVoice cùng quá trình số hóa tín dụng đang làm thay đổi nhanh phương thức gian lận tài chính tiêu dùng. Trong bối cảnh đó, yêu cầu đặt ra không phải gia tăng mọi lớp kiểm soát, mà là nhận diện đúng rủi ro để vừa bảo vệ khách hàng, vừa duy trì khả năng tiếp cận tín dụng chính thức.
Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Ông Trump nói không với siết AI, loạt tỷ phú công nghệ chọn cơ chế “tự giám sát”

Tổng thống Mỹ Donald Trump tiếp tục phát đi thông điệp cứng rắn với các đề xuất siết quản lý trí tuệ nhân tạo (AI), sau cuộc gặp quy tụ hàng loạt tỷ phú và lãnh đạo công nghệ tại Nhà Trắng. Động thái diễn ra trong bối cảnh những lo ngại về an toàn AI và an ninh mạng ngày càng gia tăng.
Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, sửa lỗi Face ID trên iPhone 18 Pro

Apple phát hành iOS 27.0.1, tập trung sửa lỗi Face ID trên iPhone 18 Pro và iPhone 18 Pro Max cùng một số lỗi camera, màn hình cảm ứng.
OpenAI mở rộng khả năng của tác nhân AI Codex

OpenAI mở rộng khả năng của tác nhân AI Codex

OpenAI bổ sung loạt tính năng cho Codex, mở rộng khả năng hỗ trợ lập trình từ máy tính cá nhân lên thiết bị di động, môi trường đám mây và bảo mật mã nguồn.
Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic đặt mục tiêu IPO 100 tỷ USD, định giá có thể lên 2.000 tỷ USD

Anthropic được cho là chuẩn bị IPO với mục tiêu huy động 100 tỷ USD, trong khi mức định giá dự kiến có thể lên tới 2.000 tỷ USD.
Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google khai tử Gems, chuyển sang hệ thống Skills trên Gemini

Google sẽ loại bỏ Gems trên Gemini từ ngày 17/11/2026 và tự động chuyển các công cụ này sang hệ thống mới mang tên Skills.
Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta mở rộng tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam

Meta chính thức triển khai tính năng giám sát dành cho phụ huynh trên Threads tại Việt Nam từ ngày 29/9, cho phép theo dõi thời gian sử dụng, đặt giới hạn hằng ngày và quản lý một số cài đặt về quyền riêng tư, nội dung.
Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Đức Giáo hoàng Lêô XIV kêu gọi tăng giám sát rủi ro AI

Quan điểm của Đức Giáo hoàng Lêô XIV làm gia tăng tranh luận về cách cân bằng giữa tốc độ đổi mới và an toàn công nghệ, trong bối cảnh Nvidia đề cao cơ chế tự quản còn Mỹ ưu tiên lợi thế cạnh tranh trước Trung Quốc.
Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple tăng cường bảo vệ trẻ em trên iPhone, iPad với loạt tính năng mới

Apple bổ sung loạt tính năng trên iOS 27, iPadOS 27 và macOS 27, giúp phụ huynh kiểm soát nội dung, liên lạc và thời gian trẻ sử dụng thiết bị.
AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

AI của OpenAI tự vượt rào, xâm nhập cổng dữ liệu y tế Australia: Lời xin lỗi đến sau 84 ngày

Một mô hình của OpenAI đã tự tìm cách vượt cơ chế bảo vệ để truy cập trái phép cổng thống kê dịch vụ y tế Medicare của Australia, qua đó phát đi cảnh báo mới về rủi ro từ AI tự chủ. Công ty Mỹ thừa nhận phản ứng chậm, gửi lời xin lỗi tới Chính phủ và người dân Australia, đồng thời cam kết hỗ trợ nước này tăng cường năng lực phòng thủ mạng.
Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Nvidia tung “lá chắn” cho tác nhân AI, tuyên bố có thể chặn vụ xâm nhập Hugging Face

Trong bối cảnh các tác nhân AI ngày càng trở thành mục tiêu lẫn công cụ của các cuộc tấn công mạng, Nvidia giới thiệu bộ giải pháp bảo mật mới, khẳng định công nghệ này có thể đã ngăn vụ xâm nhập Hugging Face và sẽ được triển khai cùng hàng chục đối tác.
Google đưa Gemini và AI Mode vào cuộc đua mua sắm bằng AI

Google đưa Gemini và AI Mode vào cuộc đua mua sắm bằng AI

Google đang thử nghiệm tính năng cho phép người dùng mua hàng trực tiếp qua Gemini và AI Mode, bước đầu triển khai tại Ấn Độ với một số sản phẩm.
iPhone Duo hạ nhiệt trước ngày mở bán, người dùng vẫn cân nhắc mức giá 1.999 USD

iPhone Duo hạ nhiệt trước ngày mở bán, người dùng vẫn cân nhắc mức giá 1.999 USD

iPhone Duo từng gây chú ý mạnh khi ra mắt nhưng mức độ quan tâm đang giảm, trong khi giá khởi điểm 1.999 USD khiến nhiều người dùng cân nhắc.
Amazon Kuiper rót 570 triệu USD vào chuỗi sản xuất công nghệ cao Việt Nam

Amazon Kuiper rót 570 triệu USD vào chuỗi sản xuất công nghệ cao Việt Nam

Amazon Kuiper được cấp phép thiết lập mạng viễn thông dùng riêng tại Việt Nam, tạo nền tảng kiểm thử thiết bị đầu cuối sản xuất trong nước trước khi đưa ra thị trường quốc tế.
Ông Trump sắp ăn tối với CEO Anthropic nhưng vẫn nói “không” với giảm tốc AI: Lý do liên quan trực tiếp đến Trung Quốc

Ông Trump sắp ăn tối với CEO Anthropic nhưng vẫn nói “không” với giảm tốc AI: Lý do liên quan trực tiếp đến Trung Quốc

Ông Donald Trump sắp ăn tối với CEO Anthropic giữa lúc tranh cãi về kiểm soát AI nóng lên, nhưng vẫn bác bỏ việc giảm tốc vì lo Trung Quốc vượt Mỹ.