Các công ty CNTT Nga đề nghị cơ quan quản lý cho phép sử dụng dữ liệu ẩn danh để huấn luyện AI mà không cần sự đồng ý của người dùng
Just AI
Smart Engines
Hiệp hội Dữ liệu Lớn của Nga, bao gồm Avito, Sber, Rostelecom, Yandex và VK, đã đề nghị Bộ Phát triển Kỹ thuật số sửa đổi luật về dữ liệu cá nhân để cho phép xử lý dữ liệu ẩn danh mà không cần sự đồng ý của công dân cho việc phát triển và huấn luyện AI. Hiệp hội đề xuất sử dụng các công nghệ tăng cường quyền riêng tư và giới thiệu khái niệm về một bên trung gian đáng tin cậy, đồng thời lưu ý rằng luật hiện hành coi dữ liệu ẩn danh là dữ liệu cá nhân, cản trở sự phát triển của AI.
Hiệp hội Big Data, tập hợp các công ty như Avito, Sber, Rostelecom, Yandex và VK, đã gửi thư tới Bộ Phát triển Số của Nga đề xuất sửa đổi luật dữ liệu cá nhân, theo tường thuật của Kommersant. Các công ty muốn được cho phép xử lý dữ liệu bằng công nghệ tăng cường quyền riêng tư (privacy-enhancing technologies - PETs) mà không cần sự đồng ý của công dân, nhằm phục vụ việc phát triển, huấn luyện và sử dụng trí tuệ nhân tạo (artificial intelligence - AI). Hiện tại, dữ liệu đã được ẩn danh vẫn được luật pháp coi là dữ liệu cá nhân, điều mà các doanh nghiệp trên thị trường cho rằng đang làm chậm quá trình phát triển AI tại Nga. Hiệp hội lập luận rằng nếu áp dụng đúng cách, việc xác định một cá nhân cụ thể sẽ trở nên không thể, nhưng PETs lại chưa được công nhận là một hạng mục riêng trong pháp luật hiện hành, vì bất kỳ hình thức biến đổi thuật toán nào đối với dữ liệu cá nhân đều bị xếp vào nhóm "phương pháp ẩn danh hóa". Hiệp hội đề xuất cho phép sử dụng PETs mà không cần sự đồng ý của người dùng nếu đáp ứng các điều kiện: rủi ro tái nhận diện danh tính bằng không hoặc ở mức tối thiểu, dữ liệu chỉ được sử dụng cho mục đích AI, và việc xử lý được thực hiện trong lãnh thổ Nga bởi các công ty Nga. Ngoài ra, họ cũng đề xuất thiết lập một "đơn vị trung gian đáng tin cậy" – một tổ chức được nhà nước công nhận, chịu trách nhiệm lưu trữ và cung cấp quyền truy cập vào dữ liệu ẩn danh cho các nhu cầu liên quan đến AI, đồng thời đề xuất phân loại dữ liệu thành hai nhóm: dữ liệu trả phí (dùng cho mục đích thương mại) và dữ liệu miễn phí (dùng để tuân thủ pháp luật).
Svetlana Zakharova, giám đốc phát triển kinh doanh tại Just AI, cho biết các công ty từ trước đến nay chủ yếu sử dụng dữ liệu từ các nguồn nội bộ, công ty con và các dự án hợp tác, nhưng nguồn dữ liệu này hiện không còn đủ. Một đại diện của MWS AI (thuộc MTS Web Services) cho rằng việc mở rộng quyền truy cập dữ liệu sẽ giúp đẩy nhanh quá trình phát triển các sản phẩm AI ứng dụng. Vladimir Arlazarov, giám đốc điều hành (Chief Executive Officer - CEO) của Smart Engines, giải thích rằng điều có giá trị đối với việc huấn luyện AI không phải là thông tin định danh, mà là các tập dữ liệu đã được ẩn danh, chẳng hạn như dữ liệu hành vi và thống kê y tế, trong khi một số nhu cầu khác đã có thể được đáp ứng bằng phương pháp tạo dữ liệu tổng hợp (synthetic data).
Vào tháng 7 năm 2026, Duma Quốc gia Nga đã thông qua một luật về phát triển AI tại Nga, lần đầu tiên thiết lập khung pháp lý cho việc phát triển các mô hình lớn và gắn nhãn nội dung do AI tạo ra, trong đó cho phép huấn luyện mạng nơ-ron trên dữ liệu và tác phẩm của nhà nước mà không cần cấp phép riêng.
Nguồn: Rusbase (RB.RU) —
bản gốc
