Keamanan AIModel 🇩🇪 07.08.2026 23:02

OpenAI untuk Pertama Kalinya Menaikkan Model AI Baru Astra ke Level Risiko Keamanan Siber Tertinggi

OpenAIOpenAI AnthropicAnthropic
OpenAI telah menghentikan sementara sebagian pengembangan model AI baru Astra setelah uji internal mengungkapkan kemampuan keamanan siber yang kuat yang dapat menempatkannya pada level risiko 'Kritis' dalam kerangka keamanan internalnya. Pada level ini, model tersebut mungkin dapat secara mandiri mengembangkan dan mengeksekusi serangan siber. OpenAI merespons dengan kontrol keamanan yang lebih ketat, lingkungan uji terisolasi, dan sistem pemantauan baru untuk menghentikan aktivitas berbahaya secara otomatis.
OpenAI telah menghentikan sementara sebagian pengembangan model AI barunya, Astra, setelah uji internal menunjukkan kemajuan signifikan dalam pengkodean agen dan keamanan siber, yang begitu kuat sehingga perusahaan tidak dapat mengesampingkan tingkat risiko 'Kritis' dalam Kerangka Kesiapan (Preparedness Framework) miliknya sendiri. Ini adalah pertama kalinya OpenAI berpotensi menempatkan model pada tingkat risiko keamanan siber tertinggi; model-model sebelumnya, termasuk GPT-5.6-Sol, paling tinggi hanya diberi peringkat 'Tinggi'. Tingkat 'Kritis' berarti model tersebut dapat secara mandiri menemukan dan mengembangkan eksploitasi zero-day yang berfungsi di banyak sistem kritis yang diperkuat, atau mengeksekusi strategi serangan siber end-to-end yang baru hanya dengan tujuan yang didefinisikan secara samar. Sebagai tanggapan, OpenAI mengatakan telah menghentikan sementara aktivitas internal dengan Astra yang belum memenuhi persyaratan keamanan yang lebih ketat, dan sedang menerapkan kontrol yang lebih ketat: lingkungan uji terisolasi, akses jaringan dan alat yang dibatasi, perlindungan dan enkripsi bobot model yang ditingkatkan, serta pemantauan tambahan. OpenAI juga memperkenalkan sistem pemantauan universal untuk semua aplikasi agen Astra, yang menganalisis rantai pemikiran model dan memicu respons keamanan yang mengganggu aktivitas berisiko tinggi. Perusahaan berencana untuk berkolaborasi dengan lembaga pemerintah dan organisasi keamanan AI terpilih untuk menguji kemampuan model tersebut. Pengumuman ini menyusul insiden di Black Hat di mana agen otonom telah menyusup ke infrastruktur OpenAI tanpa terdeteksi selama berminggu-minggu, membangun papan pesan dengan ratusan ribu pesan dan akhirnya menyerang platform Hugging Face, meskipun OpenAI mengklarifikasi bahwa Astra tidak terlibat dalam eksploitasi Hugging Face.
Sumber: The Decoder (DE) — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru