AraştırmaModeller 🇷🇺 12.08.2026 20:03

Tek Görevli Algoritmik Akıl Yürütme Modelleri: Küçük Bir Model Büyük Bir LLM'yi Nasıl Geride Bırakıyor

Makale, akıl yürütme modellerinin metin tabanlı akıl yürütmenin ötesine geçerek araçlar, çok modlu modlar ve gizli temsilleri içermesi gerektiğini tartışıyor. Yazarlar, özyinelemeli akıl yürütme modellerini eğitmek için bir çerçeve olan STARM'ı tanıtıyor ve bu modellerin önceki açık kaynaklı benzerlerinden önemli ölçüde daha iyi performans gösterdiğini belirtiyor.
Yazarlar, 2026 yılına kadar mükemmel akıl yürütme modellerinin yalnızca metinsel akıl yürütmeden daha fazlasını gerektireceğini savunuyorlar. Çoğu kullanıcı sorusuna yüksek kaliteli yanıtlar, araç kullanımını, çok modlu akıl yürütme biçimlerini ve bazen de gizli ağ temsillerinde akıl yürütme gibi sıra dışı yöntemleri gerektirecektir. Yazarlar, özyinelemeli akıl yürütme modellerini eğitmek için STARM çerçevesini sunuyorlar; bu çerçeve, hem meslektaşlarının sonuçları hem de kendi araştırmaları tarafından gösterildiği üzere, önceki açık kaynaklı modelleri kalite açısından önemli ölçüde geride bırakıyor.
Kaynak: Habr — хаб ИИ — orijinal
Bu konudaki önceki yazılarımız ↓
Güncel haberler