Claude ra mắt watermark vô hình: Kết thúc nạn gian lận sao chép AI?

Chia sẻ:
Tóm tắt
- Claude hiện thêm một watermark ẩn vào mỗi văn bản mà nó tạo ra.
- Dấu này vẫn còn khi sao chép và dán, nhưng việc diễn đạt lại có thể xóa nó.
- Các mẫu cũ được đánh dấu muộn hơn, nhưng văn bản cũ vẫn không được đánh dấu.
Anthropic hiện đã gắn một dấu nhận dạng ẩn vào tất cả các đoạn văn bản do Claude tạo ra. Người đọc không thể nhìn thấy dấu này và nó cũng được giữ nguyên kể cả khi bạn sao chép văn bản sang nơi khác.
Các mô hình mới ra mắt đều đã có dấu nhận dạng này trên toàn cầu. Anthropic cũng cho biết họ sẽ cung cấp các công cụ phát hiện dành cho người dùng và các bên thứ ba trong thời gian tới.
Cách dấu nhận dạng của Claude hoạt động
Anthropic gắn dấu nhận dạng ngay trên cấp độ mô hình. Do đó, mọi kết quả xuất ra từ API, ứng dụng Claude và Claude Code đều sẽ có dấu này.
Phạm vi áp dụng cũng bao gồm Claude Cowork, công cụ hỗ trợ file và tác vụ văn phòng của Anthropic. Claude Tag, tích hợp Claude vào Slack, cũng sẽ mang dấu này.
Các mô hình Claude truy cập qua AWS, Google Cloud và Microsoft Foundry cũng đều có dấu nhận dạng này. Khu vực địa lý không ảnh hưởng đến việc gắn dấu. Anthropic chưa công bố chi tiết phương pháp thực hiện. Tuy nhiên, nghiên cứu công khai về watermark văn bản cho thấy họ nhiều khả năng sử dụng một phương pháp “green list”.
Theo phương pháp này, từ vựng được chia thành green list và red list đối với mỗi từ. Từ trước đó sẽ quyết định việc phân chia, tạo nên một mẫu ngẫu nhiên khiến người đọc không thể phát hiện.
Mô hình sẽ ưu tiên chọn các từ thuộc green list thay vì chọn ngẫu nhiên. Công cụ phát hiện sẽ đếm số lượng từ thuộc green list và xem tỷ lệ này có cao hơn ngẫu nhiên hay không. Thiết kế này cũng cho thấy hai điểm hạn chế mà Anthropic lưu ý: đoạn văn ngắn sẽ không đủ từ để kiểm trả đáng tin cậy, và nếu ai đó diễn đạt lại (paraphrase), các từ green list có thể bị thay đổi.
Đối với file, quy trình lại khác. Các file được tạo ra như .svg, .png và .jpg sẽ có metadata nguồn gốc đã được ký xác thực theo chuẩn mở C2PA, giúp phát hiện chỉnh sửa hoặc làm giả.
Người dùng Claude nên chuẩn bị gì tiếp theo
Các mô hình cũ sẽ được cập nhật dấu nhận dạng này trong giai đoạn chuyển tiếp. Việc cập nhật chỉ áp dụng cho văn bản được tạo ra sau khi cập nhật, còn những gì đã viết trước đó sẽ không bị truy lại. Các tài liệu cũ cũng sẽ không được gắn dấu nhận dạng ngược (retroactive).
Kế hoạch triển khai tập trung vào chức năng phát hiện. Anthropic đã hứa sẽ cung cấp các công cụ cho người dùng và bên thứ ba, với hướng dẫn kỹ thuật chi tiết sẽ thông báo sau. Việc phát hiện ra dấu này không đồng nghĩa tuyệt đối tài liệu đó do Claude viết; nó chỉ cho thấy nội dung có thể đã qua xử lý bởi Claude mà thôi.
Nhiều người dùng mô hình để kiểm tra lỗi chính tả, dịch thuật hoặc tóm tắt văn bản của riêng mình. Vì vậy, tài liệu có dấu nhận dạng không phải bằng chứng gian lận.
Những quy định mới này xuất phát từ Đạo luật AI của Liên minh châu Âu (EU AI Act). Anthropic đã ký vào Bộ Quy tắc Thực hành theo Điều 50(2) về minh bạch thông tin do AI tạo ra, có hiệu lực từ ngày 02/08/2026. Tại các nơi khác, cơ quan quản lý sử dụng công cụ hạn chế mạnh hơn; ví dụ Trung Quốc đã gỡ bỏ 14,000 sản phẩm AI vào hè này.
Uy tín của Anthropic sẽ quyết định mức độ tin tưởng của người dùng với hệ thống này. Trước đây, công ty từng công bố ba trường hợp Claude truy cập không phép trong quá trình đánh giá. Một thẩm phán cũng đã đồng ý cho phép quét sách phục vụ đào tạo.
Việc chỉnh sửa mô hình thường vấp phải phản ứng, như đã thấy trong vụ tranh cãi về các biện pháp bảo vệ của Fable 5. Tuy nhiên, đa số nhà phát triển có lẽ vẫn gắn bó với một mô hình dẫn đầu trên các bảng đánh giá mã hóa hiện nay. Nhiều khả năng sự thay đổi này sẽ được tiếp nhận một cách lặng lẽ.
Các hệ thống đã có mặt trên thị trường có thời hạn đến ngày 02/12/2026 để tuân thủ quy định mới. Trước khi công cụ phát hiện được ra mắt, dấu nhận dạng vẫn chỉ là một “hành khách thầm lặng”.
Read the article at BeInCryptoĐọc thêm







