Recuperação Agêntica para a Base de Conhecimento Gerenciada do Amazon Bedrock
Amazon Web Services
As Bases de Conhecimento Gerenciadas do Amazon Bedrock introduzem a recuperação agêntica, um novo modo que decompõe perguntas de múltiplas partes, comparativas e exploratórias em subconsultas, recupera iterativamente e pode gerar uma resposta fundamentada em uma única chamada de API. Ele mostra uma melhoria absoluta de recall de até 37% em benchmarks de múltiplos saltos.
As Bases de Conhecimento Gerenciadas do Amazon Bedrock agora oferecem recuperação agentiva por meio da API AgenticRetrieveStream, que usa um modelo de fundação para planejar e iterar sobre etapas de recuperação em vez de uma única busca por similaridade. Ela lida com consultas de múltiplas intenções, comparativas e de múltiplas fontes, decompondo a pergunta, recuperando por subconsulta, avaliando a suficiência e, opcionalmente, gerando uma resposta fundamentada. A API retorna um fluxo de eventos de rastreamento (recuperação especulativa, planejamento, etapas de recuperação e resultado final), suportando até cinco bases de conhecimento com descrições em linguagem natural para roteamento. A avaliação comparativa no MuSiQue mostra uma melhoria absoluta de recall de até 37% em perguntas de 4 saltos. O preço inclui US$ 4 por 1000 chamadas com modelo gerenciado, mais US$ 1 por 1000 chamadas de recuperação subjacentes. Os usuários podem ajustar maxAgentIteration (padrão 3 para uma única KB, 4-5 para múltiplas KBs) e escolher entre modelos de fundação gerenciados pelo serviço ou personalizados.
Fonte: AWS ML blog —
original
