Mistral AI julkaisee Leanstral 1.5:n: ilmainen malli muodolliseen verifiointiin ennätystuloksilla
Mistral
OpenAI
Mistral AI on julkaissut Leanstral 1.5:n, ilmaisen Apache-2.0-lisensoidun mallin, jossa on 119B parametria yhteensä ja 6B aktiivista parametria, saavuttaen huipputuloksia muodollisessa verifioinnissa. Se saavuttaa saturaation miniF2F-vertailussa, ratkaisee 587/672 PutnamBench-ongelmaa ja asettaa uudet ennätykset FATE-H (87%) ja FATE-X (34%) -vertailuissa. Malli paljastaa myös todellisia bugeja avoimen lähdekoodin repositorioissa.
Mistral AI julkaisi Leanstral 1.5:n, ilmaisen Apache-2.0-lisensoidun mallin, jossa on yhteensä 119B parametria, joista vain 6B on aktiivisia. Tämä malli tarjoaa merkittävän suorituskyvyn parannuksen formaalissa verifioinnissa. Se saavuttaa saturaatiotason miniF2F-testissä, ratkaisee 587 PutnamBench-ongelmaa 672:sta ja saavuttaa huipputulokset FATE-H (87%) ja FATE-X (34%) testeissä. Koulutusprosessi sisälsi mid-trainingin, ohjatun hienosäädön ja vahvistusoppimisen CISPO-menetelmällä kahdessa vahvistusoppimisympäristössä: monivuorovaikutteisessa ympäristössä lauseiden todistamiseen Lean-kääntäjän palautteen avulla, ja koodiagentin ympäristössä, joka toimii kuin kehittäjä raakassa tiedostojärjestelmässä. Leanstral 1.5 osoittaa vahvaa testiajan skaalautumista: PutnamBench-suorituskyky paranee 44 ratkaistusta ongelmasta 50 000 tokenilla 587 ongelmaan 4 miljoonalla tokenilla. Se loistaa myös koodin verifioinnissa, todistaen AVL-puiden aikavaativuustakuut ja paljastaen 5 aiemmin tuntematonta bugia 57 testatussa repositoriossa. Malli on täysin avoimen lähdekoodin, saatavilla Hugging Facen kautta ja ilmaisen API-päätepisteen kautta.
Lähde: Mistral AI —
Alkuperäinen
