Couchbase construiu uma arquitetura de IA multimodelo para o Capella iQ com Amazon Bedrock
Couchbase
Anthropic
Amazon Web Services
A Couchbase implementou uma arquitetura de IA multimodelo para seu assistente de desenvolvedor Capella iQ, utilizando Amazon Bedrock e os modelos Claude da Anthropic. A solução oferece flexibilidade, tolerância a falhas e alta disponibilidade por meio do Cross-Region Inference na AWS.
No blog da AWS ML, é apresentado como a Couchbase construiu uma arquitetura de IA multimodal para o Capella iQ — um assistente de IA para desenvolvedores que gera consultas a bancos de dados, recomenda índices e suporta diálogos com múltiplos turnos. A arquitetura está implantada em duas regiões da AWS (us-east-1 e us-west-2) usando Amazon EKS, e as chamadas de modelo são realizadas via Amazon Bedrock. As consultas dos desenvolvedores são processadas pelos microsserviços cp-api, cp-internal-api e cp-ns, que determinam o roteamento e as configurações do modelo. Todo o tráfego passa pela interface VPC, sem sair para a internet pública. A inferência entre regiões (Cross-Region Inference) redireciona automaticamente as requisições entre as regiões dos Estados Unidos em caso de falhas ou picos de carga. Para a seleção do modelo, a Couchbase realizou benchmarks baseados em metodologia semelhante ao BIRD (Benchmark for In-context Retrieval and Generation): o Claude Sonnet 4.5 apresentou precisão de cerca de 76% e foi escolhido como modelo principal. O Amazon Bedrock tornou a arquitetura independente de provedor: a troca de modelo exige apenas alteração na configuração, sem modificações no código. No futuro, a Couchbase planeja usar a importação de modelos personalizados (Bedrock Custom Model Import) para otimizar o custo de tarefas de alta frequência.
Fonte: AWS ML blog —
original
