результатов в своем классе размеров по многим бенчмаркам зрения, включая понимание экрана, привязку объектов и рассуждения с несколькими изображениями. Она также показывает высокую производительность в задачах, связанных только с текстом, таких как следование инструкциям и использование инструментов. LFM2.5-VL-3B оптимизирована для логического вывода на устройстве, достигая 228 токенов в секунду на M5 Max и 116 токенов в секунду на Ryzen AI Max+ 395, а также 20 токенов в секунду на Galaxy S26 Ultra. Она поддерживает ввод с несколькими кадрами с низкой задержкой и высокой пропускной способностью на GPU, достигая примерно 11 тысяч выходных токенов в секунду при высокой степени параллелизма. Модель доступна на Hugging Face и совместима с основными средами логического вывода, включая transformers, vLLM и llama.cpp.