что позволяет проверять актуальность фактов на момент вопроса. Вопросы разделены на три супергруппы: Information Extraction (поиск и корректное использование фактов с учётом обновлений, удалений и временных зависимостей), Reasoning (рассуждение с сопоставлением, вычислениями, причинно-следственными связями и временным контекстом) и Abstention (умение признать отсутствие информации). Для каждого вопроса задаётся многослойная таксономия: семантический тип (17 типов, например StaticUser, UpdatingInfo, SocialRelationship, Arithmetic, MultiStep), количество evidence-сессий (single- или multi-session), темпоральность (temporal или atemporal) и тип временного выражения (explicit, implicit, no temporal expression). Диалоги создавались вручную: реплики пользователя писали люди, ответы ассистента генерировались с помощью GigaChat Max, вопросы и эталонные ответы верифицировались вручную. В сборе участвовало 26 контрибьюторов, процесс занял 20 рабочих дней. Английская версия получена автоматическим переводом и выверена вручную для кросс-лингвального сравнения.