Исследование противоречит Anthropic и OpenAI: автономные исследования ИИ еще далеки
Новое исследование с участием Принстона и Института безопасности ИИ Великобритании показывает, что современные передовые модели ИИ проваливают независимые исследования ИИ, несмотря на заявления таких крупных лабораторий, как Anthropic и OpenAI. Используя метод 'Shadow Evaluation' с неопубликованными работами NeurIPS, авторы-люди отклонили все созданные ИИ работы. Агенты испытывали трудности с научным суждением, творческим решением проблем и управлением ресурсами.
Исследователи из Принстонского университета и Института безопасности искусственного интеллекта Великобритании провели исследование, чтобы эмпирически проверить, могут ли AI-агенты проводить независимые исследования в области ИИ. Они использовали метод под названием «Shadow Evaluation» (теневая оценка), при этом AI-агентам предоставлялись центральные исследовательские вопросы из неопубликованных
Показать ещё ↓
Источник: The Decoder (DE) —
оригинал
