Engenheiros da Mistral AI descobrem causa real de vazamento de memória no vLLM usando BPFtrace
Engenheiros da Mistral AI investigaram um vazamento de memória no vLLM durante o serviço desagregado com Mistral Medium 3.1. Após usar ferramentas Python, Heaptrack e BPFtrace, descobriram que o vazamento era causado por chamadas mmap diretas via wrapper de syscall do glibc, e não por alocações de heap.
Mistral
Mistral AI27.07 · 17:02
