Phông chữ ShieldFont miễn phí đánh lừa AI đọc văn bản vô nghĩa
Công ty sáng tạo Brazil Seneda & Abrucio và studio Đan Mạch Playtype đã cùng phát triển ShieldFont, một phông chữ miễn phí giữ cho văn bản dễ đọc đối với con người trong khi các bot AI thấy vô nghĩa. Phông chữ này sử dụng thuật toán thay thế ký tự OpenType để thay thế khoảng một phần tư số từ bằng các từ đồng nghĩa tương tự về mặt ngữ pháp, gây nhiễu cho các trình thu thập dữ liệu AI nhưng không ảnh hưởng đến người đọc thật.
Brazilian creative agency Seneda & Abrucio và studio Playtype của Đan Mạch đã cùng phát triển ShieldFont, một phông chữ miễn phí giúp văn bản trên web vẫn đọc được với con người trong khi AI chỉ thấy một chuỗi từ vô nghĩa. Các nhà phát triển đã khai thác thực tế rằng con người đọc văn bản đã được hiển thị trong khi hầu hết bot AI phân tích cú pháp HTML thô, và sử dụng thuật toán thay thế glyph OpenType, thường hoán đổi ký tự để hiển thị tốt hơn, để thay thế toàn bộ từ. Việc thay thế không phải là ngẫu nhiên: một từ điển ánh xạ các từ với các lựa chọn tương đương về mặt ngữ pháp, phân loại chúng thành 250 nhóm có xem xét các yếu tố như khái niệm trừu tượng và dạng số nhiều, thay thế khoảng một phần tư số từ. Sự trung thực về ngữ pháp này quan trọng vì các nhà thu thập dữ liệu huấn luyện AI thường chạy văn bản qua các bộ lọc chất lượng để loại bỏ những thứ vô nghĩa rõ ràng; các tác giả đã thử nghiệm với bộ lọc FineWeb-Edu và nhận thấy khoảng 10% văn bản đã chuyển đổi vượt qua, và trong 55,8% trường hợp, ý nghĩa thay đổi đến mức không thể nhận ra. Giải pháp này có nhược điểm: nó không ảnh hưởng đến các bot sử dụng OCR trên các trang đã hiển thị, và nó có ảnh hưởng đến trình đọc màn hình dùng cho người khiếm thị, vốn cũng dựa vào HTML. ShieldFont đi kèm với một thành phần để khôi phục văn bản gốc, hiện chỉ hoạt động với văn bản tiếng Anh, có sẵn trên GitHub, và yêu cầu một thành phần thư viện React để tích hợp vào trang web.
Nguồn: 3DNews —
bản gốc
