Açık Ağırlıklı Yapay Zeka Modelleri Öncü Modellere Yetişiyor, Ancak Güvenlik Açığı Sürüyor
OpenAI
Anthropic
xAI
Google DeepMind
Yapay zeka güvenliği konusunda faaliyet gösteren kar amacı gütmeyen kuruluş SaferAI'nin yeni raporu, Çin'in açık ağırlıklı modeli GLM-5.2'nin siber ve biyolojik yetenekler açısından öncü modellerin yalnızca aylar gerisinde olduğunu, ancak güvenlik korumalarından yoksun olduğunu ortaya koyuyor. Claude Opus 4.7 gibi öncü modeller zararlı görevlerin çoğunu reddederken, GLM-5.2 hiçbirini reddetmedi; bu da açık ağırlıklı yapay zekada büyüyen güvenlik açığını vurguluyor.
SaferAI'nin Z.ai'nin açık ağırlıklı modeli GLM-5.2'yi değerlendirmesi, modelin saldırgan siber veya çift kullanımlı biyoloji görevlerinin hiçbirini reddetmediğini ortaya koyarken, Anthropic'in Claude Opus 4.7'si o kadar tutarlı bir şekilde reddetti ki SaferAI, CyberGym kıyaslamasını tamamlayamadı. Sınır modeli geliştiricileri, sınıflandırıcılar ve reddetme eğitimi gibi güvenlik önlemlerine güveniyor, ancak bunlar, kullanıcıların serbestçe değiştirebildiği açık ağırlıklı modeller için geçerli değil. SaferAI'nin icra direktörü Henry Papadatos, yeteneğin riskle aynı şey olmadığını ve güvenlik önlemlerinin dikkate alınması gerektiğini vurguladı. Ön eğitim veri filtrelemesinin yardımcı olabileceğini öne sürdü, ancak bunun siber güvenlik için daha az pratik olduğunu belirtti. Anthropic'in Opus 5'i, derlenmiş yazılımlarda güvenlik açıklarını aramamak gibi belirli siber güvenlik yardımlarını seçici olarak kısıtlıyor. SaferAI, Z.ai'nin GLM-5.2 için bir güvenlik çerçevesi veya risk değerlendirmesi yayınlamadığını belirtti. Stanford'dan Graham Webster'a göre, Çin'in yapay zeka politikası, felaket risklerinden çok politik içeriğe odaklanıyor. Savunucular, açık ağırlıkların savunmaya yardımcı olduğunu, çünkü Hugging Face'in OpenAI ihlaline karşı GLM-5.2'yi kullandığını savunuyor, ancak Papadatos tehlikeli yeteneklerin açık kaynaklı hale getirilmemesi gerektiğine inanıyor.
Kaynak: TechCrunch AI —
orijinal
