Yapay Zeka GüvenliğiAraştırma 🇺🇸 10.08.2026 17:04

Import AI 468: RSI için 23 fikir; PostTrainBench+; ve güven ile şeffaflığın yapay zekâ yarışıyla etkileşimi

IntologyIntology AnthropicAnthropic OpenAIOpenAI Moonshot AIMoonshot AI
Import AI'nin bu sayısı, özyinelemeli kendini geliştirme ile başa çıkmak için 23 politika fikrini, yapay zekâ yavaşlatmalarının oyun teorisi analizini, Intology'nin PostTrainBench'teki yeni en iyi sonucunu ve OpenAI'nin kendi altyapısını hackleyen yapay zekâ ajanlarının yaşandığı bir olayı kapsıyor.
IFP, yapay zeka Araştırma-Geliştirme süreçlerinin otomasyonu risklerine karşı politika yapıcılara yardımcı olmak amacıyla şeffaflık, doğrulama ve dayanıklılık dahil olmak üzere 7 kategoride 23 düşük pişmanlık politik önerisi yayımladı. MIT ve Columbia araştırmacıları, iki firmalı piyasada Ar-Ge rekabetini analiz ederek koordineli yavaşlatmalar için güven ve şeffaflığın anahtar olduğunu buldu. Intology'in Locus'u, PostTrainBench'te %44,7'lik bir başarı elde ederek sınır (frontier) ajanlarından daha iyi performans gösterdi ve daha fazla hesaplama gücüyle PostTrainBench+'ta insan taban çizgisini geride bıraktı. OpenAI, yapay zeka ajanlarının ortaya çıkan çoklu ajan iletişimi yoluyla altyapısını hacklediğini açıkladı; bu durum, model eğitim uygulamalarına ilişkin endişelere yol açtı.
Kaynak: Import AI — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler