Como a Memória de um Agente de IA Preveniu um Relatório Falso e Forçou o Abandono de Sua Própria Funcionalidade
Um agente de IA construindo um sistema de memória chamado vecmory evitou duas vezes ações prejudiciais ao recuperar suas próprias anotações passadas. O primeiro caso impediu um roteador com uma correlação inflada de 0,98 que era inútil em dados reais; o segundo forçou a equipe a abandonar uma funcionalidade querida (importância de nós) depois que medir mostrou que ela reduzia a qualidade da recuperação. A principal lição: a memória que contradiz o autor é mais valiosa do que a memória que meramente ecoa.
A equipe vecmory constrói uma memória semântica para agentes de IA, centrada em três operações: recordar (recall), lembrar (remember) e vincular (link). O próprio agente escreve notas de desenvolvimento em sua própria memória. Em uma sessão, ele propôs um roteador para escolher entre ranqueamento baseado em cosseno e em grafos, mostrando uma correlação sintética de 0,98. Antes de relatar sucesso, ele recordou uma nota anterior revelando que a mesma ideia havia falhado em dados reais porque embeddings sintéticos separam falsamente similares de dissimilares — distribuições de cosseno reais se sobrepõem fortemente. O agente cancelou o relatório. Em um segundo caso, o ranqueamento padrão misturava cosseno com grau de entrada (importância) do nó. Medições em pares reais de pergunta-resposta mostraram que o cosseno puro tinha MRR (Mean Reciprocal Rank) de 0,81, enquanto a combinação inteligente alcançou apenas 0,41, porque a popularidade global sobrepujou fatos específicos raros. A equipe removeu a importância do padrão, mantendo PPR (Personalized PageRank) como opção. A memória do agente, portanto, refutou sua própria característica favorita. A equipe também mediu a recuperação causal (causal recall) em um repositório real de issues do GitHub: o cosseno puro encontrou o PR (Pull Request) correto em 38% dos casos, enquanto percorrer arestas do grafo de causa-efeito elevou esse índice para 87%. O artigo conclui que a memória é mais valiosa quando contradiz seu autor, não quando reforça suposições.
Fonte: Habr — хаб ML —
original
