Multiverse Computingin AI-mallin pakkaus parantaa suorituskykyä tavallisella laitteistolla
Multiverse Computing
Multiverse Computing on esitellyt teknologian tekoälymallien pakkaamiseen, mikä parantaa merkittävästi suorituskykyä tavallisella laitteistolla. Ratkaisu mahdollistaa suurten kielimallien (engl. large language models, LLM) ajamisen tavallisilla grafiikkasuorittimilla suurella nopeudella, mikä voi vähentää infrastruktuurikustannuksia ja tehdä tekoälystä helpommin saavutettavaa.
Kvanttilaskentaan erikoistunut yritys Multiverse Computing on ilmoittanut kehittäneensä tekoälymallien pakkausmenetelmän, joka mahdollistaa niiden toiminnan huomattavan nopeuttamisen tavallisilla laitteilla. Teknologia pakkaa suuria kielimalleja (Large Language Models, LLM) ilman merkittävää tarkkuuden heikkenemistä, mikä mahdollistaa niiden ajamisen tavallisilla grafiikkaprosessoreilla (Graphics Processing Units, GPU) suorituskyvyllä, joka on verrattavissa erikoistuneiden sirujen käyttöön. Yrityksen mukaan tämä vähentää laskentakustannuksia ja energiankulutusta, tehden edistyneistä tekoälymalleista helpommin saavutettavia pienille ja keskisuurille yrityksille. Tarkempia tietoja testatuista malleista ei ole vielä paljastettu, mutta menetelmän väitetään soveltuvan erilaisiin arkkitehtuureihin.
Lähde: Meta AI (GNews) —
Alkuperäinen
