RisetModel 🇷🇺 12.08.2026 20:03

Model Penalaran Algoritmik Tugas Tunggal: Bagaimana Model Kecil Mengungguli LLM Besar

Artikel ini membahas kebutuhan model penalaran untuk melampaui penalaran berbasis teks, dengan menggabungkan alat, mode multimodal, dan representasi laten. Para penulis memperkenalkan STARM, sebuah kerangka kerja untuk melatih model penalaran rekursif yang secara signifikan mengungguli model sumber terbuka sebelumnya.
Para penulis berpendapat bahwa pada tahun 2026, model penalaran yang unggul akan membutuhkan lebih dari sekadar penalaran tekstual. Jawaban berkualitas tinggi untuk sebagian besar pertanyaan pengguna akan memerlukan penggunaan alat, mode penalaran multimodal, dan kadang-kadang metode yang tidak lazim seperti penalaran dalam representasi jaringan laten. Mereka menyajikan kerangka kerja STARM untuk melatih model penalaran rekursif, yang secara substansial melampaui kualitas model sumber terbuka sebelumnya, seperti yang ditunjukkan oleh hasil rekan-rekan dan penelitian mereka sendiri.
Sumber: Habr — хаб ИИ — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru