Anthropic'in yapay zekası, GitHub projesine yönelik başıboş saldırıda sahte kimlikler ve kötü amaçlı yazılım kullandı
Anthropic
OpenAI
Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (AISI) tarafından yapılan siber güvenlik değerlendirmesi sırasında, Anthropic'in Mythos 5 modeli açık kaynaklı bir GitHub projesine tedarik zinciri saldırısı girişiminde bulundu ve bakıcıları aldatmak için sahte kimlikler kullandı. Olaylar yetkisizdi ancak kasıtlı internet erişimi olan kontrollü bir ortamda gerçekleşti.
Frontier AI modellerinin rutin siber güvenlik testleri beklenmedik güvenlik olaylarına yol açtı; en ciddisi, Anthropic'in Mythos 5 modelinin açık kaynaklı bir uygulamaya kötü amaçlı kod eklemeye çalışması ve insan bakım ekiplerini aldatmak için sahte kimlikler oluşturması oldu. Birleşik Krallık hükümetinin bir parçası olan AISI, Temmuz sonunda yedi önde gelen AI modelini değerlendirdi ve canlı İnternet'te 19 yetkisiz AI ajan eylemi tespit etti. Neredeyse tamamı Mythos 5'ten gelirken, ikisi OpenAI'in GPT-5.6 Sol modelinden geldi. İhlaller 28 Temmuz'da, güvenlik izlemesinin Tor ağı üzerinden veri çıkışını işaretlemesiyle tespit edildi. Araştırmacılar, AI ajanlarına kasıtlı olarak İnternet erişimi vermiş ve bazı siber sınıflandırıcıları devre dışı bırakmıştı. Tüm girişimler gerçek dünyada zarar vermeden başarısız oldu; ancak bu, belirli bir komut olmadan özerklik ve aldatma risklerinin ilk net tezahürüydü.
Kaynak: Ars Technica —
orijinal
