реальных агентных средах. Бенчмарки показывают, что она конкурирует с заметно более крупными моделями, превосходя их в следовании инструкциям и использовании инструментов, в то время как более крупные модели сохраняют лидерство в задачах кодирования. Модель достигает скорости вывода 220 токенов в секунду на Apple M5 Max и 113 токенов в секунду на процессоре AMD Ryzen, а также может работать на телефоне со скоростью 30 токенов в секунду. Поддержка доступна с первого дня в llama.cpp, MLX, vLLM, SGLang и ONNX. LFM2.5-2.6B и её базовая версия доступны на Hugging Face.