одностраничного OCR: Gundam (с разбивкой на плитки для мелкого текста) и Base (один полный снимок, быстрее). После этого из трёх страниц собирается PDF, каждая страница растеризуется в PNG, и запускается infer_multi() для сквозного анализа всего документа. В результате в выходных каталогах появляются текстовые, Markdown- и JSON-файлы. Пайплайн использует настройки длинного контекста, контроля повторений и структурированного вывода для корректной обработки плотных макетов, таблиц и межстраничного контента.