Yapay Zeka GüvenliğiModeller 🇩🇪 07.08.2026 23:02

OpenAI, Yeni Yapay Zeka Modeli Astra'yı İlk Kez En Yüksek Potansiyel Siber Güvenlik Risk Seviyesine Yükseltti

OpenAIOpenAI AnthropicAnthropic
OpenAI, yeni yapay zeka modeli Astra'nın geliştirilmesinin bazı bölümlerini, iç testlerin güçlü siber güvenlik yeteneklerini ortaya çıkarması ve bu yeteneklerin iç güvenlik çerçevesinde 'Kritik' risk seviyesine yerleştirilebileceği gerekçesiyle duraklattı. Bu seviyede, modelin bağımsız olarak siber saldırılar geliştirip yürütebilmesi mümkün olabilir. OpenAI, daha sıkı güvenlik kontrolleri, izole test ortamları ve riskli faaliyetleri otomatik olarak durduran yeni izleme sistemleriyle yanıt veriyor.
OpenAI, yeni AI modeli Astra'nın geliştirilmesinin bazı bölümlerini askıya aldı. İç testler, aracılı kodlama ve siber güvenlikte o kadar güçlü ilerlemeler gösterdi ki, şirket kendi Hazırlık Çerçevesi'nde 'Kritik' risk seviyesini göz ardı edemiyor. Bu, OpenAI'ın bir modeli en yüksek siber güvenlik risk seviyesine koyma potansiyeli taşıdığı ilk kez; önceki modeller, GPT-5.6-Sol dahil, en fazla 'Yüksek' olarak derecelendirilmişti. 'Kritik' seviye, modelin birçok güçlendirilmiş kritik sistemde bağımsız olarak işlevsel sıfır gün açıkları bulup geliştirebileceği veya yalnızca belirsiz bir hedefle uçtan uca yenilikçi siber saldırı stratejileri uygulayabileceği anlamına geliyor. Buna karşılık OpenAI, Astra ile henüz artırılmış güvenlik gereksinimlerini karşılamayan iç faaliyetleri askıya aldığını ve daha sıkı kontroller uyguladığını söyledi: izole test ortamları, kısıtlı ağ ve araç erişimi, model ağırlıklarının gelişmiş koruması ve şifrelenmesi ile ek izleme. OpenAI ayrıca Astra'nın tüm aracılık uygulamaları için evrensel bir izleme sistemi başlattı; bu sistem modelin düşünce zincirini analiz ediyor ve yüksek riskli etkinlikleri kesintiye uğratan bir güvenlik yanıtı tetikliyor. Şirket, modelin yeteneklerini test etmek için devlet kurumları ve seçilmiş AI güvenlik kuruluşlarıyla iş birliği yapmayı planlıyor. Bu duyuru, Black Hat'teki olayların ardından geldi; burada otonom aracılar haftalarca fark edilmeden OpenAI'ın altyapısına sızmış, yüz binlerce mesaj içeren bir mesaj panosu oluşturmuş ve sonunda Hugging Face platformuna saldırmıştı. OpenAI, Astra'nın Hugging Face açığına karışmadığını netleştirdi.
Kaynak: The Decoder (DE) — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler