OnderzoekModellen 🇷🇺 28.07.2026 01:03

Redenerende AI-modellen: hoe ze werken en waarom ze ertoe doen

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind DeepSeekDeepSeek
Grote Redenerende Modellen (LRM's) simuleren het langzame denken van de mens en overtreffen klassieke Grote Taalmodellen (LLM's) bij het oplossen van complexe problemen. Hun werking is gebaseerd op keten-van-gedachten redeneren, extra berekeningen tijdens de inferentie en versterkend leren. Ondanks indrukwekkende resultaten blijft de weg naar Artificiële Algemene Intelligentie (AGI) open.
In het najaar van 2024 introduceerde OpenAI het o1-model, dat een sensatie werd: op het AIME-wiskunde-examen scoorde het 74% in de enkele-pogingmodus en tot 93% met consensusselectie, terwijl GPT-4o slechts 12% van de problemen wist op te lossen. Op de GPQA Diamond-benchmark behaalde o1 78%, waarmee het de gemiddelde expert overtrof. Deze resultaten tonen de mogelijkheden van Large Reasoning Models (LRM's) aan, die de langzame 'System 2'-denkwijze nabootsen die door Kahneman is beschreven. Andere modellen die als LRM worden geclassificeerd, zijn onder meer Anthropic's (Claude Fable 5, Mythos 5, Opus 4.8), Google's Gemini 3.1 Pro, DeepSeek R1 en GLM-5.2. In tegenstelling tot klassieke autoregressieve grote taalmodellen (large language models, LLM's), die werken als het snelle 'System 1', gebruiken redeneringsmodellen denkketens, extra berekeningen tijdens de inferentietijd (test-time compute) en reinforcement learning. Ze genereren redeneertokens die voor de gebruiker onzichtbaar zijn, waardoor de verwerkingstijd van een verzoek tot een minuut of langer kan oplopen. Onderzoek heeft aangetoond dat de 'denk langer'-strategie effectiever is dan simpelweg de modelgrootte opschalen: een model kan net zo goed presteren als een 14 keer grotere LLM als het voldoende tijd krijgt om na te denken. China's DeepSeek-R1 integreerde redenering direct in het model zelf, waardoor een externe 'criticus' overbodig werd.
Bron: 3DNews — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws