Mistral AI, Leanstral 1.5'i yayınladı: Rekor sonuçlarla formel doğrulama için ücretsiz model
Mistral
OpenAI
Mistral AI, toplam 119B ve etkin 6B parametreli, Apache-2.0 lisanslı ücretsiz model Leanstral 1.5'i yayınladı. Model, formel doğrulamada en son teknoloji sonuçlara ulaşıyor. miniF2F benchmark'ını doyuruyor, 587/672 PutnamBench problemini çözüyor ve FATE-H (%87) ile FATE-X (%34) üzerinde yeni rekorlar kırıyor. Ayrıca açık kaynak kod depolarında gerçek dünya hatalarını keşfediyor.
Mistral AI, Leanstral 1.5'i yayınladı. Bu, 119B toplam ve yalnızca 6B aktif parametreye sahip, ücretsiz Apache-2.0 lisanslı bir model olup resmi doğrulamada önemli bir performans artışı sağlıyor. Model miniF2F'yi doyuruyor, 672 PutnamBench probleminin 587'sini çözüyor ve FATE-H (%87) ile FATE-X (%34) üzerinde son teknoloji sonuçlar elde ediyor. Eğitim, orta düzey eğitim, denetimli ince ayar ve iki RL ortamında CISPO ile takviyeli öğrenmeyi içeriyordu: Lean derleyici geri bildirimi ile teorem kanıtlama için çoklu dönüş ortamı ve ham dosya sisteminde bir geliştirici gibi çalışan bir kod ajan ortamı. Leanstral 1.5, güçlü test zamanı ölçeklemesi gösteriyor; PutnamBench performansı 50 bin token'da çözülen 44 problemden 4M token'da 587'ye yükseldi. Ayrıca kod doğrulamada mükemmeldir, AVL ağaçları için zaman karmaşıklığı garantilerini kanıtlar ve test edilen 57 depoda daha önce bilinmeyen 5 hatayı ortaya çıkarır. Model, Hugging Face ve ücretsiz bir API uç noktası aracılığıyla tamamen açık kaynaklıdır.
Kaynak: Mistral AI —
orijinal
