Mallit RSS

Mallit 🇷🇺

Oman GPT-tyyppisen Warhammer 40K -kielimallin rakentaminen alusta alkaen. Osa 4: Ohjattu hienosäätö kysymys-vastausdatalla

Artikkelisarjan neljännessä osassa kirjoittaja hienosäätää (ohjattu hienosäätö, Supervised Fine-Tuning SFT) dekooderipohjaista kielimalliaan kysymys-vastausdatalla, jotta malli pystyy käymään keskustelua pelkän tekstin jatkamisen sijaan. Artikkeli käsittelee datan keruuta, tokenisaattorin laajentamista, datasettiin valmistelua häviön peittämisellä (loss masking) ainoastaan assistentin vastauksille sekä harjoitustuloksia: malli oppi vastausformaatin, mutta kärsii lore-epätarkkuuksista.

Hugging FaceHugging Face
Habr — хаб ИИ24.07 · 10:02
Tuoreet uutiset