Ajuste fino do ruGPT-3 XL 1.3B ao nível de LLM moderno e comparação com Gemma3 1B
Um entusiasta ajustou o modelo pré-treinado ruGPT-3 XL 1.3B (de 2020) usando SFT (Ajuste Fino Supervisionado) e DPO (Otimização Direta de Preferência) para o nível de LLM moderno. O modelo resultante foi comparado com o Gemma3 1B de 2025; em muitos testes, o ruGPT-3 XL apresentou respostas mais precisas e concisas, especialmente em tarefas de lógica e conhecimento da cultura russa.
Сбербанк
Google/DeepMind
