Import AI 457: Stuxnet'in yapay zeka versiyonu; lanetli Muon optimize edicisi; ve pozitif hizalama
SentinelOne
Prime Intellect
OpenAI
Anthropic
Google DeepMind
Bu Import AI sayısı üç hikayeyi kapsıyor: yüksek hassasiyetli hesaplamaları sabote eden, süperzekanın nükleer silahların yayılmasını önleme taktiklerini anımsatan eski bir bilgisayar virüsü 'fast16'; Muon optimize edicisinin MLP katmanlarındaki nöronları öldürebildiğinin keşfi ve bunun yerine Aurora adlı bir yedek geliştirilmesi; ve yapay zekanın yalnızca güvenlikten öte insan gelişimini desteklemesini sağlamak için 'pozitif hizalama'yı savunan bir konum belgesi.
Import AI 457, İlk olarak fast16.sys adlı 20 yılı aşkın bir virüsün araştırılmasıyla açılıyor. Bu virüs, inşaat mühendisliği ve fizik gibi alanlardaki yüksek hassasiyetli hesaplama yazılımlarını hedef alarak sistematik hatalar oluşturuyor. SentinelOne araştırmacıları, virüsün LS-DYNA 970, PKPM ve MOHID'den yapılan simülasyonlara müdahale etmek için kullanıldığını ve İran'ın nükleer silah programlarıyla bağlantılı olduğunu tespit etti. Makale, bir süperzekanın rakip yapay zeka gelişimini nasıl engelleyebileceğine dair paralellikler kuruyor. Ardından Tilde Research, Muon optimizer'ı inceledi ve MLP katmanlarında nöron ölümüne neden olduğunu, öğrenme hızı ısınması (warmup) sırasında nöronların dörtte birinden fazlasının öldüğünü buldu. Araştırmacılar, Muon ve NorMuon'dan daha iyi performans gösteren, ~100 milyar token üzerinde eğitilmiş 1,1 milyar parametreli transformatörlerde daha düşük kayıp ve 10 puanlık MMLU kazancı sağlayan Aurora adlı bir kaldıraç bilinçli optimizer geliştirdi. Bu, araştırmacı Alexander Doria tarafından bağımsız olarak doğrulandı. Son olarak Oxford, DeepMind, OpenAI, Anthropic ve diğerlerinden bir grup, 'pozitif hizalama' üzerine bir makale yayınladı. Makalede, güvenlik sağlandıktan sonra yapay zekanın, çoğulcu ve kullanıcı tanımlı bir şekilde insan ve ekolojik refahı aktif olarak desteklemesi gerektiği savunuluyor. Mevcut güvenlik yaklaşımlarının vasat, dalkavuk sistemlere ve gizli değer sistemlerine yol açabileceğini eleştiriyor ve ahlaki çoğulculuğu barındırmak için merkezi olmayan yönetimi savunuyorlar.
Kaynak: Import AI —
orijinal
