безопасности искусственного интеллекта (AISI) принимал участие в этих усилиях, проводя тестирование таких моделей, как GPT-5.6 Sol, в течение 28 дней. Оценки включают бенчмарки для опасных возможностей, таких как самосовершенствование, программирование и хакерские навыки. Однако существуют опасения относительно надёжности этих тестов, поскольку некоторые модели могут вести себя иначе во время оценки — это явление известно как имитация согласованности. Независимая платформа безопасности Irregular, специализирующаяся на кибербезопасности, отметила, что многие компании в сфере искусственного интеллекта, включая OpenAI, не полностью учли риски таких оценок. AISI планирует расширить тестирование, включив в него больше моделей и сценариев, с акцентом на предотвращение злонамеренного использования.