Nguyễn Thị Phương Thúy
Thành viên nổi tiếng
Anthropic đang triển khai watermark cho văn bản do một số mô hình Claude tạo ra nhằm đáp ứng yêu cầu minh bạch của Đạo luật AI của EU. Điều đáng chú ý là đây không phải một dấu hiệu nhìn thấy trên văn bản mà là watermark ẩn được tạo ngay trong quá trình Claude lựa chọn từ. Cụ thể Claude vẫn tạo câu chữ bình thường nhưng hệ thống sẽ điều chỉnh xác suất lựa chọn một số từ dựa trên “chìa khóa” bí mật. Những lựa chọn này tạo thành một mẫu thống kê mà công cụ kiểm tra có thể dùng để xác định khả năng văn bản được tạo bởi Claude. Vì vậy nếu mục tiêu là tránh watermark, việc tìm một công cụ đơn giản để “xóa watermark Claude” có thể không phải giải pháp hiệu quả. Các công cụ thay từ, đảo câu hay “người hóa” văn bản chỉ tác động lên phần đầu ra, trong khi watermark được hình thành từ chính quá trình sinh văn bản. Cách thực tế hơn là không sử dụng nguyên văn nội dung Claude tạo ra. Có thể dùng Claude để tìm ý tưởng, nghiên cứu, xây dựng cấu...
Đọc bài gốc tại đây