с помощью SFTTrainer из Hugging Face. После дообучения модель научилась понимать вопросы, давать корректные ответы, соблюдать шаблон диалога и завершать генерацию токеном EOS. Автор также провёл сравнение с современной моделью Gemma3 1B (2025 года), обученной на 2 триллионах токенов. В тестах на знание русских рок-групп, многоходовые диалоги, сложные вопросы по физике, загадки и краткие ответы ruGPT-3 XL показала лучшие или сравнимые результаты, хотя в некоторых задачах, например, при имитации Linux-терминала, Gemma3 1B справилась лучше. Также отмечается, что модель может использовать цепочку рассуждений (CoT) для повышения качества ответов. После дообучения модель была конвертирована в формат GGUF для удобного использования в llama.cpp.