Couchbase a construit une architecture IA multimodèle pour Capella iQ avec Amazon Bedrock
Couchbase
Anthropic
Amazon Web Services
Couchbase a déployé une architecture IA multimodèle pour son assistant développeur Capella iQ, utilisant Amazon Bedrock et les modèles Claude d'Anthropic. La solution offre flexibilité, tolérance aux pannes et haute disponibilité grâce à l'inférence inter-régions sur AWS.
Dans le blog AWS ML, on explique comment Couchbase a construit une architecture IA multimodèle pour Capella iQ, un assistant IA destiné aux développeurs, capable de générer des requêtes de base de données, de recommander des index et de gérer des dialogues multithread. L'architecture est déployée dans deux régions AWS (« us-east-1 » et « us-west-2 ») avec Amazon EKS, et les appels aux modèles sont effectués via Amazon Bedrock. Les requêtes des développeurs sont traitées par les microservices cp-api, cp-internal-api et cp-ns, qui déterminent le routage et les configurations du modèle. Tout le trafic transite par une interface VPC, sans passer par l'Internet public. L'inférence interrégionale (Cross-Region Inference) redirige automatiquement les requêtes entre les régions américaines en cas de panne ou de pic de charge. Pour choisir le modèle, Couchbase a réalisé des benchmarks selon une méthodologie similaire à BIRD : Claude Sonnet 4.5 a atteint une précision d'environ 76 % et a été retenu comme modèle principal. Amazon Bedrock a permis de rendre l'architecture indépendante du fournisseur : changer de modèle nécessite simplement de modifier la configuration, sans toucher au code. À l'avenir, Couchbase prévoit d'utiliser l'importation de modèles personnalisés (Bedrock Custom Model Import) pour optimiser le coût des tâches à haute fréquence.
Source: AWS ML blog —
original
