RuGPT-3 XL 1.3B:n hienosäätö nykyaikaiselle kielimallitasolle ja vertailu Gemma3 1B:hen
Harrastaja hienosääti esikoulutetun ruGPT-3 XL 1.3B -mallin (vuodelta 2020) SFT:n ja DPO:n avulla nykyaikaiselle kielimallitasolle. Tuloksena saatua mallia verrataan vuoden 2025 Gemma3 1B -malliin; monissa testeissä ruGPT-3 XL osoitti tarkempia ja ytimekkäämpiä vastauksia, erityisesti logiikkatehtävissä ja Venäjän kulttuurin tuntemuksessa.
Сбербанк
Google/DeepMind
