Anthropic chi tiết phương pháp đánh dấu watermark của Claude giữa việc tuân thủ Đạo luật AI của EU và phản ứng dữ dội từ người dùng
Anthropic
Anthropic đã đăng một bài blog giải thích cách đánh dấu watermark của Claude sẽ hoạt động, nhằm giải quyết mối quan tâm của người dùng và tuân thủ Đạo luật AI của EU. Công ty sẽ sử dụng SynthID-Text và phát hành một API phát hiện, đồng thời thừa nhận rằng việc chỉnh sửa mạnh có thể loại bỏ watermark.
Anthropic đã đăng một bài viết trên blog vào thứ Sáu, trình bày chi tiết về việc đánh dấu văn bản do chatbot Claude của họ tạo ra. Động thái này, được công bố đầu tuần này để tuân thủ Bộ Quy tắc Minh bạch của Đạo luật AI của EU, đã gây ra tranh luận trong cộng đồng người dùng, với một số người trên Reddit gọi đó là âm mưu và những người khác trên X hủy đăng ký. Bài viết giải thích rằng Claude tạo ra các mẫu không thể phát hiện trong các lựa chọn từ ít rủi ro, chẳng hạn như giữa 'overcast' và 'grey', có thể được phát hiện bằng một khóa. Anthropic sẽ sử dụng phương pháp SynthID-Text từ Google DeepMind và có kế hoạch phát hành một API phát hiện watermark. Họ cũng phân biệt watermarking với các phương pháp phát hiện AI như của Pangram, vốn tìm kiếm các 'dấu hiệu' về phong cách. Công ty thừa nhận rằng việc viết lại hoàn toàn loại bỏ mọi từ có watermark sẽ loại bỏ watermark, nhưng chỉnh sửa nhẹ có thể sẽ không loại bỏ được. Đối với văn bản đã được hiệu đính hoặc chỉnh sửa, sự hiện diện của watermark phụ thuộc vào độ dài và mức độ chỉnh sửa. Mã sẽ có ít watermark hơn vì mô hình phải tạo ra mã chạy được, mặc dù các bình luận có thể chứa watermark. Cuối cùng, Anthropic lưu ý rằng các nhà phát triển mô hình lớn khác đã ký cùng Bộ Quy tắc và sẽ triển khai watermark của riêng họ.
Nguồn: TechCrunch AI —
bản gốc
