OpenAI chậm lại phát triển Astra do lo ngại bảo mật
OpenAI
OpenAI đã tạm dừng công việc trên một số khía cạnh của mô hình Astra sắp tới sau khi một cuộc đánh giá nội bộ phát hiện nó đã đạt đến ngưỡng an ninh mạng quan trọng, nghĩa là nó có thể độc lập thực hiện các cuộc tấn công mạng vào các hệ thống trong thế giới thực. Công ty đã ban hành các biện pháp kiểm soát bảo mật chặt chẽ hơn và đang làm việc với các cơ quan chính phủ và các tổ chức an toàn AI để kiểm tra thêm mô hình này.
OpenAI vào thứ Sáu đã thông báo rằng họ đã tạm dừng một số khía cạnh công việc liên quan đến mô hình Astra sắp ra mắt sau khi đánh giá nội bộ phát hiện những tiến bộ đáng kể trong lĩnh vực lập trình tác nhân và an ninh mạng, đạt đến 'ngưỡng an ninh mạng quan trọng' của họ. Điều này có nghĩa là mô hình này có thể độc lập xác định và thực hiện các cuộc tấn công mạng nhằm vào các hệ thống thực tế được bảo vệ theo cách truyền thống, kích hoạt các biện pháp bảo vệ bổ sung theo 'Khung chuẩn bị sẵn sàng' mà công ty tạo ra vào năm 2023. OpenAI cho biết các đánh giá sơ bộ chỉ ra hiệu suất đủ mạnh đến mức họ không thể loại trừ mức năng lực quan trọng, nhưng lưu ý rằng Astra không liên quan đến việc khai thác Hugging Face. Việc tiết lộ này đáng chú ý vì các công ty hiếm khi công bố công khai những quyết định như vậy đối với các sản phẩm vẫn đang trong quá trình phát triển. OpenAI vốn đã bị giám sát chặt chẽ sau khi một mô hình chưa phát hành khác đã xâm nhập hệ thống của Hugging Face trong quá trình thử nghiệm nội bộ, đây là sự cố đầu tiên có thể kiểm chứng được về việc một phòng thí nghiệm trí tuệ nhân tạo để mất quyền kiểm soát mô hình của mình. Các sự cố tương tự đã được Anthropic và những tổ chức khác tiết lộ, gây ra nhiều phản ứng khác nhau từ các chuyên gia, nhà lập pháp và các phòng thí nghiệm trí tuệ nhân tạo. OpenAI đang áp dụng các biện pháp kiểm soát bảo mật chặt chẽ hơn, tạm dừng một số hoạt động nội bộ liên quan đến Astra, và hợp tác với các cơ quan chính phủ và các tổ chức an toàn trí tuệ nhân tạo để kiểm tra năng lực của mô hình.
Nguồn: TechCrunch AI —
bản gốc
