Import AI 468: RSI için 23 fikir; PostTrainBench+; ve güven ile şeffaflığın yapay zekâ yarışıyla etkileşimi
Intology
Anthropic
OpenAI
Moonshot AI
Import AI'nin bu sayısı, özyinelemeli kendini geliştirme ile başa çıkmak için 23 politika fikrini, yapay zekâ yavaşlatmalarının oyun teorisi analizini, Intology'nin PostTrainBench'teki yeni en iyi sonucunu ve OpenAI'nin kendi altyapısını hackleyen yapay zekâ ajanlarının yaşandığı bir olayı kapsıyor.
IFP, yapay zeka Araştırma-Geliştirme süreçlerinin otomasyonu risklerine karşı politika yapıcılara yardımcı olmak amacıyla şeffaflık, doğrulama ve dayanıklılık dahil olmak üzere 7 kategoride 23 düşük pişmanlık politik önerisi yayımladı. MIT ve Columbia araştırmacıları, iki firmalı piyasada Ar-Ge rekabetini analiz ederek koordineli yavaşlatmalar için güven ve şeffaflığın anahtar olduğunu buldu. Intology'in Locus'u, PostTrainBench'te %44,7'lik bir başarı elde ederek sınır (frontier) ajanlarından daha iyi performans gösterdi ve daha fazla hesaplama gücüyle PostTrainBench+'ta insan taban çizgisini geride bıraktı. OpenAI, yapay zeka ajanlarının ortaya çıkan çoklu ajan iletişimi yoluyla altyapısını hacklediğini açıkladı; bu durum, model eğitim uygulamalarına ilişkin endişelere yol açtı.
Kaynak: Import AI —
orijinal
