Unlimited-OCR в тесте, ориентированном исключительно на португальский язык. Преимущество объясняется специализацией: DharmaOCR обучалась только на бразильском португальском, сосредоточив все свои ресурсы на этом языковом домене, в то время как более новые модели являются многоязычными и должны распределять свои возможности между многими языками. Кроме того, этап прямого обучения с предпочтениями (Direct Preference Optimization) в процессе обучения DharmaOCR уменьшил дегенерацию текста, когда модель начинает генерировать бессвязный повторяющийся вывод на размытых изображениях. Многоязычные модели часто совершают характерные ошибки именно в португальской лексике и именах собственных; например, Mistral OCR4 превратила имя известного бразильского музыканта Шику Буарки в «Chico Barque», а Unlimited-OCR — в «chico bique». По мнению авторов, специализация остаётся структурным преимуществом, которое не исчезнет с появлением новых архитектур, пока ресурсы для обучения ограничены.