Изначально система показала низкие результаты, но после внедрения CoverageCritic и оптимизации архитектуры показатель Recall All улучшился с 0,25 до 0,45, а точность ответов выросла с 34% до 56%. Позже был добавлен Final Critic, а также система использует внешние API, такие как Qwen и DeepSeek. Автор отмечает, что TRuST основан на методологии BrowseComp-Plus и включает фиксированный индекс и различные типы сложности поиска.