Mistral AI julkaisee Mistral Small 4:n: Monipuolinen malli, jossa on päättelykyky ja multimodaalisuus
Mistral
NVIDIA
Mistral AI on julkaissut Mistral Small 4:n, mallin, joka yhdistää päättelykyvyn, multimodaalisuuden ja agenttiohjelmoinnin yhteen ratkaisuun. Mallissa on 119 miljardia parametria (8 miljardia aktiivista), se tukee tekstiä ja kuvia, kontekstin pituus on jopa 256 000 tokenia ja päättelyyn käytettävää vaivaa voidaan säätää joustavasti. Mistral Small 4 on saatavilla Apache 2.0 -lisenssillä.
Mistral AI on julkaissut Mistral Small 4 -nimisen uuden mallin, joka kuuluu Small-perheeseen ja yhdistää ensimmäistä kertaa yhtiön lippulaivamallien ominaisuuksia: Magistral (päättely), Pixtral (multimodaalisuus) ja Devstral (agenttikoodaus). Käyttäjät voivat säätää päättelyn vaivannäön tasoa reasoning_effort-parametrin avulla, valiten nopeiden vastausten ja syvällisten monivaiheisten päättelyketjujen välillä. Malli käyttää Mixture of Experts -arkkitehtuuria, jossa on 128 asiantuntijaa (4 aktiivista tokenia kohden), yhteensä 119 miljardia parametria, joista 8 miljardia on aktiivisia (mukaan lukien upotus- ja tulostuskerrokset). Konteksti-ikkuna on 256 000 tokenia. Verrattuna Mistral Small 3:een täyden suorituksen aika on lyhentynyt 40 prosenttia ja suorituskyky on kasvanut kolminkertaiseksi. Mistral Small 4 ylittää GPT-OSS 120B:n tehokkuudessa, tuottaen merkittävästi lyhyempiä vastauksia samalla tai paremmalla laadulla. Malli julkaistaan Apache 2.0 -lisenssillä ja on saatavilla Mistral API:n, AI Studion sekä NVIDIA build.nvidia.com -alustan kautta NIM-muodossa. Mistral Small 4 tukee teksti- ja kuvasyötteitä, mikä mahdollistaa sen käytön keskusteluun, koodaukseen, dokumenttianalyysiin ja monimutkaiseen päättelyyn. Yhtiö ilmoitti myös liittyvänsä NVIDIA Nemotron Coalition -yhteisön perustajajäseneksi.
Lähde: Mistral AI —
Alkuperäinen
