Ajuste fino de ruGPT-3 XL 1.3B al nivel de LLM moderno y comparación con Gemma3 1B
Un aficionado ajustó el modelo preentrenado ruGPT-3 XL 1.3B (de 2020) utilizando entrenamiento supervisado fino y optimización de preferencias directas hasta alcanzar el nivel de los LLM modernos. El modelo resultante se compara con Gemma3 1B de 2025; en muchas pruebas, ruGPT-3 XL mostró respuestas más precisas y concisas, especialmente en tareas de lógica y conocimiento de la cultura rusa.
Сбербанк
Google/DeepMind
