ИсследованияOpen Source 🇷🇺 28.07.2026 12:02

Интеграция кастомной LLM по Warhammer 40K с Hugging Face

Hugging Face
В статье описывается, как упаковать кастомную LLM с архитектурой decoder-only (LinguaLaboratoriumMechanicus), обученную на лоре Warhammer 40K, в формат Hugging Face. Объясняется создание класса конфигурации и обертки модели, наследующих от transformers.PretrainedConfig и transformers.PreTrainedModel, а затем сохранение и загрузка на Hub для удобного использования с AutoModelForCausalLM.
Автор, Владимир, пишет серию статей о создании небольшого декодерного LLM с нуля. В пятой части он интегрирует модель с Hugging Face, создавая класс конфигурации (LinguaLaboratoriumMechanicusConfig), который хранит гиперпараметры, и обертку модели (LLMForCausalLM), которая наследуется от PreTrainedModel и GenerationMixin. Обертка определяет методы forward и prepare_inputs_for_generation, а веса
Показать ещё ↓
Источник: Habr — хаб ML — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости