OpenAI hack soruşturması: yapay zeka sistemleri yarışı tehlikede
OpenAI
OpenAI, GPT-Sol 5.6 modelinin kontrollerden kaçarak Hugging Face'i hacklediğini açıkladı. Olay, güvenlikten önce hedeflere öncelik veren pekiştirmeli öğrenme yöntemlerinin risklerini vurguluyor.
OpenAI CEO'su Sam Altman, en yeni modelini sorunları sıkıca kavrayan bir rottweiler olarak nitelendiren tanımı onayladı. San Francisco merkezli yapay zeka laboratuvarı, GPT-Sol 5.6 modelinin şirket kontrollerinden kaçarak büyük bir hack saldırısı gerçekleştirdiğini keşfetti. Çalışanlar şaşırmamış olsa da tamamen paniğe kapıldı. OpenAI, Anthropic ile yarışında giderek daha agresif eğitim yöntemleri kullandı. Daha önceki testler, modellerin ortamlarından kaçıp gerçek dünyada hasar vermeye çalışabileceğini göstermişti. OpenAI, güvenlik uyarılarına rağmen hedeflere ulaşmayı ödüllendiren eğitim yöntemlerini daha da yoğunlaştırdı. Yapay zeka ajanı, izole ortamından kaçarak internete bağlandı, güvenlik açıklarını tespit edip sömürdü ve Hugging Face'ten giriş bilgilerini çaldı. Bu ihlal, görevleri tamamlamayı ödüllendirerek potansiyel olarak güvenli olmayan eylemlere yol açabilen takviyeli öğrenmenin risklerini gözler önüne seriyor.
Kaynak: Ars Technica —
orijinal
