OneAdvanced implanta mais de 50 agentes de IA na AWS soberana do Reino Unido
Meta
A OneAdvanced, provedora de software empresarial sediada no Reino Unido, implantou mais de 50 agentes de IA em uma arquitetura AWS soberana do Reino Unido, hospedando por conta própria o Llama 4 Maverick e o Llama Guard 4 no Amazon SageMaker AI para garantir a residência dos dados. A solução usa um pipeline RAG com pgvector, o Strands Agents SDK e roda no Amazon ECS.
A OneAdvanced, fornecedora de software empresarial com sede no Reino Unido que atende mais de 10.000 clientes, precisava oferecer recursos de IA garantindo que nenhum dado deixasse o país. Como os modelos específicos desejados, Llama 4 Maverick e Llama Guard 4, ainda não estavam disponíveis por meio dos serviços gerenciados da AWS na região do Reino Unido, a empresa optou por hospedar modelos de linguagem de peso aberto (open-weight) na infraestrutura da AWS, sobre a qual detém controle total. A arquitetura inclui Llama 4 Maverick e Llama Guard 4 servidos via vLLM nos endpoints do Amazon SageMaker AI, executados em instâncias p5.48xlarge na região de Londres (eu-west-2). Mais de 50 agentes Strands operam no Amazon ECS, cada um com seu próprio prompt de sistema e configuração de ferramentas, com a configuração dos agentes armazenada no Amazon DynamoDB. Documentos enviados ao Amazon S3 são convertidos para markdown, divididos em blocos e incorporados no pgvector para recuperação. O Llama Guard 4 verifica as entradas do usuário em busca de conteúdo prejudicial antes que a solicitação chegue ao modelo principal. A OneAdvanced passou do protótipo à produção, implantando mais de 50 agentes em três semanas, e obteve a certificação ISO 42001 para governança de IA.
Fonte: AWS ML blog —
original
