Cách hoạt động của tính năng đánh dấu văn bản của Claude
Anthropic
Anthropic giải thích chi tiết kỹ thuật của tính năng đánh dấu văn bản của Claude, tính năng này nhúng một hình mờ vô hình vào văn bản do AI tạo ra để giúp truy vết nguồn gốc. Hệ thống hoạt động bằng cách thay đổi tinh tế cách chọn từ trong quá trình tạo, tạo ra một mẫu có thể phát hiện mà không ảnh hưởng đến khả năng đọc.
Anthropic đã công bố một bài giải thích kỹ thuật về cách hoạt động của tính năng đánh dấu văn bản (watermarking) của Claude. Đánh dấu này là một mẫu vô hình được nhúng trong văn bản được tạo ra, cho phép Anthropic phát hiện xem một đoạn văn bản có phải do Claude sản xuất hay không. Nó hoạt động bằng cách thực hiện các lựa chọn giả ngẫu nhiên, tinh tế giữa các từ thay thế hợp lý trong quá trình tạo văn bản, dựa trên một khóa mật mã. Điều này tạo ra một dấu hiệu thống kê có thể được nhận diện sau đó, trong khi vẫn không thể nhận thấy đối với người đọc. Hệ thống được thiết kế để giúp giảm thiểu việc sử dụng sai mục đích bằng cách cho phép truy xuất nguồn gốc của nội dung do AI tạo ra. Anthropic nhấn mạnh rằng đánh dấu này mạnh mẽ và không làm giảm chất lượng hoặc sự trôi chảy của văn bản.
Nguồn: Anthropic (GNews) —
bản gốc
