Работы с показателем участия ИИ свыше 70% отклонялись редакторами в 70% случаев, а тексты с минимальным использованием ИИ — лишь в 43,7%. Рецензии, подготовленные ИИ, были менее разнообразными: в них чаще обсуждались теоретические рамки, но меньше внимания уделялось данным и методам. Однако эксперимент группы Джеймса Эванса показал, что более продвинутые модели могут предлагать удивительно новые идеи. Модель Qwen3-14B, обученная на рецензиях учёных, превзошла универсальные модели на 27%. Учёные приходят к выводу, что ИИ полезен, но требует проверки человеком и изменения системы оценки.