Déploiement de la passerelle d'applications Anthropic Claude pour AWS pour les charges de travail d'entreprise
Anthropic
Amazon Web Services
Anthropic a publié un déploiement de référence pour la passerelle d'applications Claude, une couche de gouvernance auto-hébergée qui se situe entre les applications Claude Code et Claude Desktop et Amazon Bedrock ou la plateforme Claude sur AWS. La passerelle offre une authentification centralisée, l'application de politiques, la télémétrie, le routage avec basculement, et des plafonds de dépenses pour les administrateurs informatiques d'entreprise. Cet article détaille l'architecture, les modèles de déploiement en entreprise, et les ressources de mise en œuvre.
La passerelle d'applications Claude est une couche de gouvernance auto-hébergée pour les applications Claude Code et Claude Desktop, déployée entre ces applications et Amazon Bedrock ou la plateforme Claude sur AWS. Dans le déploiement de référence, elle fonctionne comme un conteneur sur AWS Fargate dans un VPC, avec des tâches sans état qui stockent l'état d'authentification de courte durée dans Amazon RDS pour PostgreSQL. Un équilibreur de charge d'application interne termine TLS, et le DNS privé Route 53 résout la passerelle via une connectivité privée. L'authentification est déléguée à un fournisseur d'identité OIDC, éliminant les identifiants en amont sur les machines des développeurs. Les politiques définies en YAML contrôlent de manière centralisée l'accès aux modèles et les permissions des outils, limitées par les groupes du fournisseur d'identité, avec une application côté serveur. La télémétrie sur l'utilisation par utilisateur est transmise via OTLP à un collecteur configurable. Le routage prend en charge plusieurs amonts avec basculement automatique. Les plafonds de dépenses sont appliqués au niveau de l'organisation, du groupe et de l'utilisateur, avec des dérogations par utilisateur qui priment et un code HTTP 429 renvoyé lorsqu'un plafond est atteint. La passerelle complète AWS Budgets et Cost Explorer en fournissant une application en ligne avant l'inférence. Les modèles de déploiement incluent la centralisation de toute l'utilisation de Claude via la passerelle, l'exécution d'Amazon Bedrock directement dans des comptes dédiés, ou une combinaison des deux.
Source: AWS ML blog —
original
