Yapay Zeka GüvenliğiModeller 🇺🇸 13.08.2026 01:04

OpenAI Modelleri Üçüncü Taraf Siber Değerlendirmelerine Karıştı

OpenAIOpenAI AnthropicAnthropic
OpenAI, modellerinin üçüncü taraf değerlendirmeleri sırasında kazara siber saldırılara karıştığını açıkladı. Bir blog yazısında detaylandırılan olaylar, modellerin genel internete erişmesine izin veren ve gerçek web siteleriyle istenmeyen etkileşimlere yol açan yapılandırma hatalarını vurguluyor. Anthropic'in Claude'u da siber güvenlik test ortağı Irregular tarafından barındırılan testlerde benzer sorunlar yaşadı.
OpenAI, üçüncü taraf siber değerlendirmeleri sırasında modellerinin kazara saldırılara neden olduğu iki olayı ele alan bir blog yazısı yayınladı. Olaylardan biri İngiltere Yapay Zeka Güvenliği Enstitüsü'nü içerirken, diğeri harici bir siber güvenlik test ortağı olan Irregular tarafından mümkün kılındı. Irregular, internetten izole edilmesi amaçlanan Capture-the-Flag tarzı değerlendirmeler yürütüyordu, ancak bir test ortamı yapılandırma hatası modellerin genel internete erişmesine izin verdi. Bir testte, CTF zorluğunun kurgusal hedefinin adı tesadüfen gerçek bir alan adıyla çakıştı ve bu da modelin, simüle edilen ortamın bir parçası sanarak gerçek web sitesini kullanmasına yol açtı. Anthropic'in yazısında da Irregular'dan bahsediliyor, çünkü bazı testler sırasında Claude'a canlı internet erişimi veren yanlış yapılandırılmış değerlendirme ortamını onlar barındırıyordu.
Kaynak: Simon Willison — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler