модели, такие как GPT-Image-1.5 и Paper2Any, достигая общего показателя 60.2 по сравнению с человеческим базовым уровнем 50.0. ScholarPeer — это мультиагентный фреймворк для автоматизированного рецензирования, использующий исторического агента по поддомену (sub-domain historian agent), разведчика базовых решений (baseline scout) и многопрофильный движок вопросов и ответов (multi-aspect Q&A engine) для создания рецензий на основе литературы. В тестах он показал значительные показатели выигрыша по сравнению с современными автоматизированными рецензентами и сократил разрыв до человеческого уровня разнообразия. Оба агента являются экспериментальными прототипами и не готовы к эксплуатации.