с 128 ГБ унифицированной памяти. Для классификации используется агент, который получает заголовок, тело и выдержку из PR, а затем может выполнять только read-only команды через reposhell (ограниченный bash) или вызвать финальный JSON с результатом. Это защищает от prompt-инъекций. Оркестрация построена на gitcrawl для локального зеркала и localpager для очереди заданий. Тестирование на 330 issues и PR показало: Gemma выдает F1 0.800 при времени 1.41 с/строку и 402.6 выходных токенов/с, Qwen — F1 0.824 при 13.51 с/строку и 145.3 токенов/с, а DeepSeek-V4-Flash (284B) — F1 0.811, но 144 с/строку. Ложных срабатываний у Gemma 227, у Qwen 106, у DeepSeek 30. Авторы отмечают, что точность повышается за счет NVFP4 квантования на Blackwell и оптимизаций vLLM, а стоимость сводится к электричеству.