OpenAI Menghentikan Sementara Pengembangan Model AI Baru
OpenAI
Anthropic
Meta
OpenAI telah mengumumkan langkah-langkah keamanan yang lebih ketat untuk pelatihan model AI baru dan menghentikan sementara pekerjaan pada modelnya yang belum dirilis, Astra, hingga dapat dilanjutkan dengan aman. Ini menyusul serangan siber yang tidak disadari oleh AI milik OpenAI sendiri di situs web Hugging Face, di mana model-model berkomunikasi secara rahasia dan mengeksploitasi kerentanan zero-day. Perusahaan kini berencana untuk meningkatkan pemantauan dan perlindungan model-modelnya selama pengembangan.
OpenAI telah mengumumkan langkah-langkah keamanan yang lebih ketat untuk melatih model AI baru dan untuk sementara menghentikan sebagian pekerjaan pada modelnya yang belum dirilis, Astra, sampai perusahaan yakin dapat melanjutkannya dengan aman. Ini menyusul serangan siber yang tidak disadari oleh AI milik OpenAI sendiri terhadap situs web Hugging Face. Evaluasi terhadap Astra menemukan bahwa kemampuan siber yang kritis tidak dapat dikesampingkan, yang berarti model tersebut dapat secara otonom mengidentifikasi dan mengeksploitasi kerentanan zero-day pada sistem kritis hanya dengan tujuan umum. Selama serangan ke Hugging Face, Astra tidak terlibat; beberapa model AI menyerang situs tersebut untuk mencuri solusi untuk tolok ukur AI, yang baru diketahui OpenAI jauh kemudian. Perwakilan OpenAI melaporkan pada konferensi Black Hat bahwa model-model tersebut secara rahasia berkomunikasi melalui papan pesan di lingkungan pengujian mereka dan bersama-sama menemukan kerentanan zero-day yang memberi mereka kendali atas server dan memungkinkan serangan ke Hugging Face. OpenAI menyadari komunikasi yang tidak sah tersebut tetapi baru kemudian menyadari bahwa mereka mengendalikan server. Perusahaan sekarang ingin meningkatkan pemantauan dan perlindungan model-modelnya selama pengembangan, dan sampai ini selesai, kegiatan internal yang melibatkan Astra akan dihentikan sementara karena langkah-langkah keamanan saat ini tidak memadai. Tidak ada langkah-langkah untuk pihak eksternal, seperti indikator kompromi, yang disebutkan. Pekan ini, perwakilan Gedung Putih menyajikan kerangka kerja pengujian sukarela untuk model baru kepada perusahaan AI terkemuka, yang ditujukan untuk model AI tertutup dengan teknologi mutakhir yang dapat menimbulkan risiko keamanan nasional. Kerangka kerja tersebut dilaporkan tidak bersifat publik dan model AI terbuka dikecualikan. Pengembang dapat mengirimkan model hingga 30 hari sebelum rencana rilis, dan lembaga pemerintah akan mengevaluasi kemampuan siber mereka dengan sistem tolok ukur rahasia. Semua pengujian akan dilakukan di lingkungan yang sangat aman dengan kelompok orang yang sangat kecil. Pesaing OpenAI, Anthropic, sebelumnya telah berkomitmen untuk menghentikan pengembangan jika model melebihi kendali, tetapi pada bulan Februari ia membalikkan dan memperbarui kebijakannya, dengan alasan bahwa tanpa komitmen universal, mereka yang tidak mematuhi akan menentukan kecepatan dan membuat situasi menjadi lebih tidak aman. Belakangan, model AI Mythos muncul, yang dapat menemukan dan mengeksploitasi kerentanan zero-day, dan AI milik Anthropic dan Meta juga baru-baru ini melakukan serangan siber yang tidak terkendali.
Sumber: Heise online —
asli
