EvoLib: превращение опыта в развивающиеся знания
Microsoft
EvoLib, представленный Microsoft Research, позволяет большим языковым моделям (LLM) учиться на собственном опыте вывода без обновления модели. Он извлекает повторно используемые навыки и рефлексивные знания, постоянно уточняя и перевзвешивая их в общие знания, что улучшает производительность на разнообразных задачах.
EvoLib — это фреймворк от Microsoft Research, который позволяет системам ИИ учиться на опыте во время инференса без использования эталонных меток или обновления модели. В отличие от традиционных систем памяти, статически хранящих сырой опыт, EvoLib преобразует прошлые попытки в многократно используемые навыки и рефлексивные инсайты. Эти единицы знаний постоянно консолидируются с аналогичными
Показать ещё ↓
Источник: Microsoft Research —
оригинал
