Ingenieros de Mistral AI descubren la causa real de una fuga de memoria en vLLM usando BPFtrace
Los ingenieros de Mistral AI investigaron una fuga de memoria en vLLM durante el servicio disagregado con Mistral Medium 3.1. Después de usar herramientas de Python, Heaptrack y BPFtrace, descubrieron que la fuga era causada por llamadas directas a mmap a través del envoltorio de syscall de glibc, no por asignaciones de heap.
Mistral
Mistral AI27.07 · 17:02
