МоделиИсследования 🇷🇺 13.08.2026 00:05

Как мне не удалось заставить Gemma 4 писать хорошие русские стихи: поучительная история о переобучении и слепых метриках

Google/DeepMind
AI-инженер Даниил Шеремет потратил месяц на тонкую настройку Gemma 4, чтобы она писала русские стихи с правильным размером и рифмой, но все версии после тонкой настройки показали результаты хуже базовой модели. Настоящей причиной оказалась не модель, а ошибочный конвейер оценки: собственный оценщик, который не мог отличить стихи от прозы, плюс проблема с токенизацией знаков ударения. После исправления оценщика и проведения надлежащих A/B-тестов базовая модель победила, что подчеркивает важный урок об оценке выходных данных LLM.
Даниил Шеремет, AI-инженер из Agentic Lab, потратил месяц на попытки заставить Gemma 4 писать русские стихи с правильным ямбом и рифмой. Его план включал тонкую настройку с помощью LoRA, систему «критик-редактор», ограниченное декодирование и другие техники. Он создал собственный сканер стихов, вдохновленный инструментом RPST Ильи Козырева, для оценки метра и рифмы. Он собрал датасет из
Показать ещё ↓
Источник: Habr — хаб ИИ — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости