Couchbase construyó una arquitectura de IA multimodelo para Capella iQ con Amazon Bedrock
Couchbase
Anthropic
Amazon Web Services
Couchbase implementó una arquitectura de IA multimodelo para su asistente de desarrollador Capella iQ, utilizando Amazon Bedrock y los modelos Claude de Anthropic. La solución ofrece flexibilidad, tolerancia a fallas y alta disponibilidad mediante Inferencia entre Regiones en AWS.
En el blog de AWS ML se explica cómo Couchbase construyó una arquitectura de IA multimodal para Capella iQ, un asistente de IA para desarrolladores que genera consultas a bases de datos, recomienda índices y admite diálogos multihilo. La arquitectura está desplegada en dos regiones de AWS (us-east-1 y us-west-2) utilizando Amazon EKS, y las invocaciones de modelos se realizan a través de Amazon Bedrock. Las consultas de los desarrolladores son procesadas por los microservicios cp-api, cp-internal-api y cp-ns, que determinan el enrutamiento y las configuraciones del modelo. Todo el tráfico pasa por la interfaz de VPC, sin salir a internet público. La inferencia entre regiones (Cross-Region Inference) redirige automáticamente las solicitudes entre regiones de EE. UU. en caso de fallos o picos de carga. Para seleccionar el modelo, Couchbase realizó un benchmarking con una metodología similar a BIRD, es decir, "Benchmarking for Information Retrieval and Data" (punto de referencia para recuperación de información y datos). Claude Sonnet 4.5 obtuvo una precisión de alrededor del 76% y fue elegido como modelo principal. Amazon Bedrock permitió que la arquitectura fuera independiente del proveedor: cambiar de modelo solo requiere modificar la configuración, sin alterar el código. En el futuro, Couchbase planea utilizar la importación de modelos personalizados (Bedrock Custom Model Import) para optimizar el costo de tareas de alta frecuencia.
Fuente: AWS ML blog —
original
