они самостоятельно разместили открытые LLM на инфраструктуре AWS, которую полностью контролируют. Архитектура включает Llama 4 Maverick и Llama Guard 4, обслуживаемые через vLLM на конечных точках Amazon SageMaker AI, работающих на экземплярах p5.48xlarge в регионе Лондон (eu-west-2). Более 50 агентов Strands работают на Amazon ECS, каждый со своим системным промптом и настройками инструментов, при этом конфигурации агентов хранятся в Amazon DynamoDB. Документы, загружаемые в Amazon S3, преобразуются в формат Markdown, разбиваются на фрагменты и встраиваются в pgvector для поиска. Llama Guard 4 проверяет пользовательские вводы на вредоносный контент до того, как запрос достигнет основной модели. OneAdvanced перешёл от прототипа к производству, развернув более 50 агентов за три недели, и получил сертификацию ISO 42001 для управления искусственным интеллектом.