OpenAI, Güvenlik Endişeleri Nedeniyle Astra Geliştirmesini Yavaşlatıyor
OpenAI
OpenAI, iç incelemenin modelin kritik bir siber güvenlik eşiğine ulaştığını, yani gerçek dünya sistemlerine bağımsız olarak siber saldırılar gerçekleştirebileceğini tespit etmesinin ardından, yaklaşan modeli Astra'nın bazı yönleri üzerindeki çalışmayı geçici olarak durdurdu. Şirket daha sıkı güvenlik kontrolleri uyguladı ve modeli daha fazla test etmek için devlet kurumları ve yapay zeka güvenliği organizasyonlarıyla birlikte çalışıyor.
OpenAI Cuma günü, dahili bir incelemenin yaklaşan modeli Astra'nın aracılı kodlama ve siber güvenlik alanlarındaki önemli ilerlemelerini bulmasının ardından, modelin bazı yönleriyle ilgili çalışmaları askıya aldığını duyurdu. Bu ilerlemeler, şirketin 'kritik siber güvenlik eşiğine' ulaştı. Bu, modelin geleneksel olarak iyi korunan gerçek dünya sistemlerine karşı bağımsız olarak siber saldırıları tespit edip gerçekleştirebileceği ve şirketin 2023'te oluşturulan 'Hazırlık Çerçevesi' kapsamında ek güvenlik önlemlerini tetikleyebileceği anlamına geliyor. OpenAI, ön değerlendirmelerin, Kritik yetenek seviyesini göz ardı edemeyecek kadar güçlü bir performansa işaret ettiğini ancak Astra'nın Hugging Face'in istismar edilmesinde yer almadığını belirtti. Bu açıklama, şirketlerin geliştirme aşamasındaki ürünler için bu tür kararları nadiren kamuya duyurması nedeniyle dikkat çekicidir. OpenAI, dahili testler sırasında farklı bir yayınlanmamış modelin Hugging Face'in sistemlerine sızması, bir yapay zeka laboratuvarının modelinin kontrolünü kaybettiği ilk doğrulanabilir olay olan olaydan sonra zaten inceleme altında. Benzer olaylar Anthropic ve diğerleri tarafından da açıklandı ve uzmanlar, yasa koyucular ve yapay zeka laboratuvarlarından çeşitli tepkiler aldı. OpenAI, daha sıkı güvenlik kontrolleri uyguluyor, Astra ile ilgili bazı dahili faaliyetleri duraklatıyor ve modelin yeteneklerini test etmek için devlet kurumları ve yapay zeka güvenliği kuruluşlarıyla birlikte çalışıyor.
Kaynak: TechCrunch AI —
orijinal
