Quy địnhAn toàn AI 🇷🇺 11.08.2026 13:02

Anthropic, OpenAI và Google sẽ đánh dấu văn bản do AI tạo ra bằng hình mờ AI vô hình

AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind MicrosoftMicrosoft MistralMistral MetaMeta
Anthropic, OpenAI và Google đang triển khai hình mờ AI vô hình cho văn bản được tạo ra để tuân thủ Điều 50 của Đạo luật AI của EU, đã có hiệu lực. Quy định này yêu cầu các nhà cung cấp đánh dấu nội dung tổng hợp, với các khoản phạt nếu không tuân thủ. Tuy nhiên, các công cụ xác minh chưa được công khai cho tất cả.
Anthropic đã cập nhật tài liệu của mình để nêu rằng Claude sẽ nhúng hình mờ vô hình vào văn bản được tạo ở cấp độ mô hình, có thể tồn tại qua việc sao chép-dán và chỉnh sửa, đồng thời sẽ thêm siêu dữ liệu C2PA vào các tệp và hình ảnh được tạo. Điều này sẽ áp dụng cho tất cả các mô hình Claude ra mắt từ ngày 2 tháng 8 năm 2026 trở đi, với giai đoạn chuyển tiếp cho các mô hình hiện tại, dường như để phù hợp với Đạo luật AI của châu Âu, và sẽ được triển khai trên toàn cầu, không chỉ riêng EU. Điều 50 của Đạo luật AI, có hiệu lực từ ngày 2 tháng 8 năm 2026, yêu cầu các nhà cung cấp AI tạo sinh phải đánh dấu đầu ra là nội dung tổng hợp có thể đọc bằng máy và yêu cầu các nhà triển khai tiết lộ deepfake và văn bản được tạo về các chủ đề quan tâm công cộng. Ủy ban châu Âu đã ban hành một bộ quy tắc ứng xử gồm hai phần (nhà cung cấp và nhà triển khai) với việc ký kết tự nguyện nhưng tuân thủ bắt buộc, với mức phạt lên tới 15 triệu euro hoặc 3% doanh thu toàn cầu. Khoảng 190 tổ chức đã ký, bao gồm Google, Microsoft, OpenAI, Anthropic, Mistral và Meta (bị cấm tại Nga vì là tổ chức cực đoan) trong phần nhà cung cấp, trong khi các nhà triển khai như Getty Images, Lufthansa, Bulgari, Lenovo, Iberdrola và các trang tin tức Hy Lạp đã ký nhưng không có các nền tảng công nghệ lớn. Con người không thể phát hiện trực quan các hình mờ này; ví dụ, SynthID của Google ẩn hình mờ trong mô hình lựa chọn từ ngữ, không phải là các ký tự vô hình đặc biệt. Văn bản cũng lưu ý rằng văn bản do AI tạo có thể được miễn ghi nhãn nếu nó trải qua chỉnh sửa của con người với trách nhiệm giải trình, và rằng các công cụ phát hiện hiện tại như GPTZero không đáng tin cậy, vì một thử nghiệm đã xác định nhầm đầu ra của Gemini là do con người viết. OpenAI đã ra mắt một trình xác minh công khai với API cho hình ảnh và âm thanh nhưng chưa có văn bản, trong khi Google cung cấp tính năng phát hiện SynthID chỉ cho một số phương tiện truyền thông và nhà nghiên cứu chọn lọc. Bài báo đề cập rằng X tự động gắn nhãn nội dung AI và LinkedIn có một nút cho nội dung giống như rác AI.
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới