Dil Modelleri Bilimsel Devrimleri Tetikleyemez, Ancak Dünya Modelleri Bunu Yapabilir
Google DeepMind
OpenAI
Google/DeepMind
Sakana AI
Google DeepMind'den Tom Zahavy'nin bir pozisyon bildirisi, büyük dil modellerinin (LLM'ler) bilimsel keşif için gereken bilişsel mekanizmadan, özellikle de yeni aksiyomlara yaratıcı sıçrama olan 'manipülatif abduksiyon'dan yoksun olduğunu savunuyor. Zahavy, simülasyonlarda aktif müdahaleye izin veren dünya modellerinin ileriye dönük bir yol olabileceğini öne sürüyor.
Google DeepMind'den Tom Zahavy, 'LLM'ler Sıçrayamaz' başlıklı bir konum belgesinde, dil modellerinin bilimsel devrimleri tetikleyemeyeceğini çünkü gerçekten yeni fikirler yaratmak için gereken temel bilişsel mekanizmadan yoksun olduklarını savunuyor. Einstein'ın keşif modelini bir döngü olarak kullanıyor: duyusal deneyimden sezgisel bir 'sıçrama' ile aksiyomlara, ardından mantıksal türetmeyle test edilebilir sonuçlara. Zahavy üç tür akıl yürütmeyi ayırt ediyor: tümdengelim, tümevarım ve abdüksiyon ve LLM'lerin tümevarım ile tümdengelimi yönettiğini ancak 'manipülatif abdüksiyonu' - henüz dilsel bir şablonu olmayan bir nedeni icat etmeyi - yönetemediğini iddia ediyor. Bunu Einstein'ın çalışmasıyla örneklendiriyor ve o dönemde bir veri krizi olmadığını; Newton fiziğinin, Merkür'ün yörüngesindeki küçük bir anormallik dışında oldukça doğru olduğunu ve tamamen optimize edici bir yapay zekanın, uzayı ve zamanı yeniden düşünmek yerine varsayımsal bir gezegen icat etmiş olabileceğini belirtiyor. Zahavy, Einstein'ın 'en mutlu anı'nın - serbest düşen gözlemci - formül manipülasyonundan değil, bedensel bir duygu olan gömülü simülasyondan geldiğini savunuyor. Bunu Arşimet'in küvetteki 'evreka' anıyla karşılaştırıyor. Dil modelleri bu duyusal temelden yoksun; tıpkı 'Çin Odası' gibi - gömülü deneyime erişmeden sembolleri hareket ettiriyorlar. Sakana'nın AI Scientist ve DeepMind'ın AlphaEvolve gibi sistemlerinin bilimi otomatikleştirebileceğini ancak ya mevcut kavramları yeniden birleştirdiklerini ya da Einstein'ın asla sahip olmadığı net bir hata sinyali gerektirdiklerini belirtiyor. Potansiyel bir yol olarak Zahavy, fiziksel olarak tutarlı dünya modellerini öneriyor: Veo gibi video üreticileri yalnızca sonraki kareyi tahmin eder, ancak Genie gibi eylem kontrol edilebilir dünya modelleri, ajanların müdahale etmesine ve karşı olgusal deneyler yapmasına olanak tanır ve yeni aksiyomlar icat etmek için gereken geri bildirimi sağlar. Zahavy temkinli davranarak, makalenin bu sıçramanın kritik darboğaz olduğunu 'öne sürdüğünü' ancak kanıtlamadığını söylüyor.
Kaynak: The Decoder (DE) —
orijinal
