Implementación de Anthropic Claude Apps Gateway para AWS en cargas de trabajo empresariales
Anthropic
Amazon Web Services
Anthropic ha publicado una implementación de referencia para el gateway de aplicaciones Claude, una capa de gobernanza autohospedada que se sitúa entre Claude Code y las aplicaciones Claude Desktop, y Amazon Bedrock o la plataforma Claude en AWS. El gateway ofrece autenticación centralizada, aplicación de políticas, telemetría, enrutamiento con conmutación por error y límites de gasto para administradores de inteligencia artificial empresarial. Esta publicación detalla la arquitectura, los patrones de implementación empresarial y los recursos de implementación.
La puerta de enlace de aplicaciones Claude es una capa de gobernanza autoalojada para las aplicaciones Claude Code y Claude Desktop, que se implementa entre estas aplicaciones y Amazon Bedrock o la Plataforma Claude en AWS. En la implementación de referencia, se ejecuta como un contenedor en AWS Fargate dentro de una VPC, con tareas sin estado que almacenan estado de autenticación de corta duración en Amazon RDS para PostgreSQL. Un balanceador de carga de aplicaciones interno termina TLS, y el DNS privado de Route 53 resuelve la puerta de enlace a través de conectividad privada. La autenticación se delega a un proveedor de identidad OIDC, eliminando las credenciales ascendentes en las máquinas de los desarrolladores. Las políticas definidas en YAML controlan de forma centralizada el acceso a los modelos y los permisos de las herramientas, delimitadas por grupos del proveedor de identidad, con aplicación en el lado del servidor. La telemetría sobre el uso por usuario se reenvía a través de OTLP a un recopilador configurable. El enrutamiento admite múltiples sistemas ascendentes con conmutación automática por error. Se aplican límites de gasto a nivel de organización, grupo y usuario, con anulaciones por usuario que tienen prioridad y se devuelve HTTP 429 cuando se alcanza un límite. La puerta de enlace complementa AWS Budgets y Cost Explorer al proporcionar una aplicación en línea antes de la inferencia. Los patrones de implementación incluyen centralizar todo el uso de Claude a través de la puerta de enlace, ejecutar Amazon Bedrock directamente en cuentas dedicadas, o una combinación de ambos.
Fuente: AWS ML blog —
original
