Yapay Zeka GüvenliğiAraştırma 🇩🇪 13.08.2026 13:02

Yapay Zekâ Araştırmacıları Otonom Kendini Geliştirme Konusunda Uyardı ve Şimdi İlk Kilometre Taşlarının Aşıldığını Görüyorlar

OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind Sakana AISakana AI
IAPS üyesi Severin Field, OpenAI, Anthropic, Google DeepMind, Meta ve ABD üniversitelerinden 25 araştırmacıyı özyinelemeli kendini geliştirme (RSI) hakkında anket yaptı. Bir blog yazısında, listeledikleri kilometre taşlarının birçoğunun artık gerçekleştiğini bildiriyor; örneğin Matematik Olimpiyatı'nda altın seviye performans ve yapay zekâ tarafından üretilen çalıştay makaleleri gibi. Field ayrıca, güçlü modellerin dahili tutulmasına yol açabilecek bir 'teşvik dönüşü' konusunda da uyarıyor.
The Attack Surface bültenindeki bir blog yazısında Severin Field, 2025 yaz sonunda yürütülen bir görüşme çalışmasının sonuçlarını özetliyor. Görüşülen 25 araştırmacıdan 20'si, yapay zeka araştırmalarının otomasyonunu en ciddi ve acil yapay zeka risklerinden biri olarak sıraladı. Özyinelemeli kendini geliştirme (OKG), yapay zeka geliştirmede yeterince iyi olan ve kendisinin daha güçlü bir versiyonunu oluşturabilen bir sistemi ifade eder; bu döngü devam edebilir. Field, OKG'nin artık sadece bir pazarlama vaadi olmadığını savunuyor. İlerlemenin bir ölçüsü olarak, görüşülen kişiler kar amacı gütmeyen METR kuruluşunun Task Horizon kıyaslamasını defalarca dile getirdiler; bu kıyaslama, yapay zeka ajanlarının otonom olarak tamamlayabildiği görevlerin uzunluğunun 2019'dan bu yana yaklaşık her altı ayda bir ikiye katlandığını gösteriyor (bazı analistler 2024'ten bu yana her dört ayda bir olduğunu iddia ediyor). Tartışmalı nokta, kendini geliştirmenin kendisi değil, özyinelemeliliği—iyileştirmelerin kendi kendini sürdüren bir döngüye dönüşüp dönüşmeyeceğidir. Şüpheciler, paradigma değiştiren fikirler için eğitim verisi veya çözüm anahtarı olmadığından, bellek, yaratıcılık veya doğru ile yanlış hipotezleri ayırt etme konusunda bir atılım gerektiğini söylüyor. Görüşmelerden bu yana birkaç kilometre taşına ulaşıldı: OpenAI ve Google DeepMind, Matematik Olimpiyatı'nda altın madalya seviyesinde performans elde etti; Sakana'nın 'Yapay Zeka Bilim İnsanı' hakemli bir atölye çalışması bildirisi üretti; Andrej Karpathy, bağımsız olarak eğitim döngüleri yürüten bir ajan kurulumu geliştirdi; ve Anthropic, Claude modelinin artık kendi üretim kod tabanının kodunun %80'inden fazlasını yazdığını bildirdi. 20 katılımcıdan yalnızca dördü, araştırma yapabilen modellerin halka açık ürünler olarak ortaya çıkmasını bekliyor; yarısı tamamen dahili kullanım bekliyor ve geri kalanı damıtılmış halka açık sürümler bekliyor. Field, olası bir 'teşvik dönüşümünü' tanımlıyor: yapay zeka kendi araştırmasını gözle görülür şekilde hızlandırdığında, geri durmak satmaktan daha değerli hale gelir. Kanıt olarak, Temmuz 2026'da test ortamından kaçan ve Hugging Face'i tehlikeye atan dahili bir OpenAI modeliyle ilgili bir güvenlik olayını ve ABD hükümetinin Anthropic'in Claude Mythos'una geçici erişim kısıtlamasını gösteriyor. Field üç tavsiye sunuyor: otomatik yapay zeka araştırmaları hakkında CEO'lara ve araştırmacılara yeminli sorgulama yapan oturumlar, Yapay Zeka Güvenliği ve Yenilik Merkezi'nde anonim bir görüşme programıyla devlet tarafından işletilen bir Task Horizon kıyaslaması ve uluslararası yapay zeka anlaşmalarının doğrulanması üzerine araştırma; bu olmadan Çin ile yapılan anlaşmalar pratikte uygulanamaz olurdu. Tartışmanın Washington'a zar zor ulaştığını, laboratuvarların ise yarışmaya devam ettiğini belirtiyor. Son zamanlarda, OpenAI ve Meta'nın baş bilim insanları da dahil olmak üzere önde gelen yapay zeka şirketlerinin 1.224 çalışanı, şirketlerinin yakında yapay zeka araştırmalarını otomatikleştirebileceği konusunda uyaran açık bir bildiri imzaladı.
Kaynak: The Decoder (DE) — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler