контексту (8192 токена) на полной смеси данных. По результатам бенчмарков модель на 350 млн параметров заняла четвёртое место среди 14 моделей, обойдя более крупные модели размером до 3,5 млрд параметров, в то время как модель на 230 млн параметров превзошла ModernBERT-base и все модели EuroBERT. Тесты скорости инференса показывают, что LFM2.5-Encoder-230M является самой быстрой на процессоре при всех длинах последовательностей; при длине 8192 токена она обрабатывает прямой проход примерно за 28 секунд, тогда как ModernBERT-base — примерно за 90 секунд (в 3,7 раза быстрее). На графическом процессоре энкодеры лидируют для входных данных длиной более 2000 токенов. Модели имеют открытые веса на Hugging Face и поддерживают дообучение для задач классификации, на уровне токенов и поиска. Демонстрации включают нуль-шотный выбор промптов, проверку политик, проверку орфографии, обнаружение персональных данных (PII) и генерацию текста с маскированной диффузией.