MallitLaitteisto ja päättely 🇺🇸 12.08.2026 18:02

LFM2.5-VL-3B: Liquid AI:n uusi visio-kielimalli reunalaittelille

Liquid AILiquid AI Google/DeepMindGoogle/DeepMind Alibaba/QwenAlibaba/Qwen
Liquid AI on julkaissut LFM2.5-VL-3B:n, kompaktin visio-kielimallin, joka on suunniteltu tehokkaaseen laitteen sisäiseen päättelyyn. Se tarjoaa parannuksia näytön ymmärtämisessä, ankkuroinnissa, monikuvapäättelyssä ja funktiokutsuissa. Malli ylittää samankokoiset kilpailijat monilla vertailutesteillä ja on optimoitu CPU- ja GPU-käyttöön.
Liquid AI on julkaissut LFM2.5-VL-3B -mallin, joka on 3,1 miljardin parametrin vision-kielimalli reunalaiteille. Se yhdistää SigLIP2 400M NaFlex -visioenkooderin yhtiön LFM2.5-2.6B -tekstipohjaan ja on koulutettu noin 34 biljoonalla tokenilla, joista visiodataa on neljä kertaa enemmän kuin aiemmissa versioissa. Malli saavuttaa luokkansa parhaat tulokset monilla visiomittareilla, kuten näytön ymmärtämisessä, ankkuroinnissa ja monikuva-argumentoinnissa. Se osoittaa myös vahvaa suorituskykyä tekstiä käsittelevissä tehtävissä, kuten ohjeiden noudattamisessa ja työkalujen käytössä. LFM2.5-VL-3B on optimoitu laitteen sisäiseen päätelmään, saavuttaen 228 tokenia sekunnissa M5 Maxilla, 116 tokenia sekunnissa Ryzen AI Max+ 395:llä ja jopa 20 tokenia sekunnissa Galaxy S26 Ultralla. Se tukee monikehyssyöttöä alhaisella viiveellä ja korkealla läpäisyllä GPU:illa, saavuttaen noin 11 000 lähtötokenia sekunnissa suurella samanaikaisuudella. Malli on saatavilla Hugging Facessa ja yhteensopiva tärkeimpien päätelmäkehysten kanssa, kuten transformers, vLLM ja llama.cpp.
Lähde: Hugging Face blog — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset