МоделиАгенты 🇺🇸 13.08.2026 19:06

Liquid AI представляет LFM2.5-VL-3B: компактная модель «vision-language» для чтения экрана, привязки объектов и вызова инструментов на устройстве

Liquid AI Google/DeepMind
Liquid AI выпустила модель LFM2.5-VL-3B, версию с 3,1 млрд параметров для развертывания на устройствах. Она отлично справляется с чтением цифровых экранов, привязкой объектов и вызовом инструментов, достигая среднего показателя 69,4 по 28 бенчмаркам vision, что соответствует более крупным моделям. Модель занимает около 3 ГБ памяти и эффективно работает на оборудовании Apple, а ее уникальная открытая лицензия бесплатна для компаний с годовым доходом менее 10 миллионов долларов.
Компания Liquid AI объявила о выпуске модели LFM2.5-VL-3B — это визуально-языковая модель с 3,1 млрд параметров, предназначенная для развертывания на устройствах. Модель считывает цифровые экраны на мобильных, веб- и настольных платформах, привязывает объекты к координатам, обрабатывает документы и диаграммы, а также вызывает инструменты на основе текстового или графического ввода. В среднем она
Показать ещё ↓
Источник: MarkTechPost — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости