Модели рассуждающего ИИ: как они работают и почему это важно
OpenAI
Anthropic
Google/DeepMind
DeepSeek
Большие модели рассуждения (Large Reasoning Models, LRM) имитируют медленное человеческое мышление, превосходя классические большие языковые модели (Large Language Models, LLM) в решении сложных задач. Их работа основана на цепочке рассуждений, дополнительных вычислениях во время инференса и обучении с подкреплением. Несмотря на впечатляющие результаты, путь к общему искусственному интеллекту (Artificial General Intelligence, AGI) остаётся открытым.
Осенью 2024 года OpenAI представила модель o1, которая стала сенсацией: на экзамене AIME по математике она набрала 74% в режиме однократной попытки и до 93% при консенсусном выборе, тогда как GPT-4o справилась лишь с 12% задач. На бенчмарке GPQA Diamond o1 достигла 78%, превзойдя среднего эксперта. Эти результаты демонстрируют возможности больших моделей рассуждений (Large Reasoning Models, LRM),
Показать ещё ↓
Источник: 3DNews —
оригинал
