существующие результаты, полученные людьми, включая недавние работы Baluyot, Goldston, Suryajaya и Turneage-Butterbaugh, адаптирующие технику Montgomery 1973 года без предположения истинности самой гипотезы, а также статью Bombieri 2000 года, можно объединить способом, который никто прежде не пробовал. Задачу поставил Jared Sumner, сотрудник Anthropic, не являющийся математиком, который в основном отправлял модели ободряющие сообщения вроде «продолжай» и «верь в себя», чтобы преодолеть её первоначальный скептицизм. Во второй попытке Claude координировал около 60 субагентов на протяжении полутора суток, выполнив 2400 команд оболочки, написав сотни скриптов на Python и проведя тысячи численных проверок с использованием двух сессий Claude Code и 31 миллиона выходных токенов. Затем модель самостоятельно организовала проверку: субагенты рецензировали доказательства друг друга, искали контрпримеры, заново доказывали результат с нуля и загрузили 54 статьи с arXiv (открытого архива электронных препринтов научных статей), чтобы убедиться в новизне подхода. Проверку со стороны людей провели два штатных математика Anthropic, Levent Alpoge и Ralph Furman, а также внешние эксперты Brian Conrey, чей рекорд 1989 года продержался более 20 лет, и Dan Goldston, соавтор работ, на которые опиралась модель; кроме того, Eric Izley формализовал доказательство в системе Lean, и оно прошло машинную верификацию. Anthropic отмечает, что эти методы вряд ли приведут к полному доказательству гипотезы Римана, что статья ещё не прошла независимое рецензирование в научном журнале и что основная математическая часть выведена людьми, однако этот случай демонстрирует потенциал ИИ в обнаружении незамеченных связей в уже существующей научной литературе.