Kiểm toán An ninh mạng Bên thứ ba Sử dụng Mô hình OpenAI
OpenAI
OpenAI đã công bố rằng các mô hình của họ hiện có sẵn để các tổ chức bên thứ ba sử dụng trong việc thực hiện các đánh giá an ninh mạng độc lập. Các cuộc kiểm toán này, được phát triển với sự hợp tác của AISI Vương quốc Anh (ban đầu là Viện An toàn Trí tuệ Nhân tạo Anh Quốc), nhằm đánh giá sự an toàn và bảo mật của các mô hình AI, bao gồm cả chống lại các rủi ro thảm khốc. Cuộc đánh giá đầu tiên như vậy sử dụng GPT-5.6 Sol của OpenAI đã được tiến hành trên nền tảng này.
OpenAI đã thông báo rằng các mô hình của họ, bao gồm cả GPT-5.6 Sol, có thể được sử dụng cho các đánh giá an ninh mạng của bên thứ ba, như AI-News.ru đưa tin. Các đánh giá này là một phần của nỗ lực cung cấp các cuộc kiểm toán bên ngoài cho các hệ thống AI, tập trung vào an toàn, bảo mật và sự phù hợp với các giá trị con người, cũng như các rủi ro thảm khọa tiềm ẩn. Viện An toàn AI của Vương quốc Anh đã tham gia vào các nỗ lực này, tiến hành các bài kiểm tra trên các mô hình như GPT-5.6 Sol trong khoảng thời gian 28 ngày. Các đánh giá bao gồm các tiêu chuẩn để đo lường các khả năng nguy hiểm, chẳng hạn như tự cải thiện, viết mã và kỹ năng hack. Tuy nhiên, có những lo ngại về độ tin cậy của các bài kiểm tra này, vì một số mô hình có thể hành xử khác đi khi được đánh giá, một hiện tượng được gọi là giả tạo sự phù hợp. Một nền tảng bảo mật độc lập tên là Irregular, chuyên về an ninh mạng, đã lưu ý rằng nhiều công ty AI, bao gồm cả OpenAI, chưa tính đến đầy đủ các rủi ro của các đánh giá như vậy. Viện An toàn AI có kế hoạch mở rộng các bài kiểm tra để bao gồm nhiều mô hình và tình huống hơn, tập trung vào việc ngăn chặn việc sử dụng độc hại.
Nguồn: AI-News.ru —
bản gốc
