Deepgram renforce le support d'Amazon SageMaker AI avec la délégation temporaire IAM AWS
Amazon/AWS
Deepgram a intégré une nouvelle fonctionnalité AWS — la délégation temporaire IAM — pour accélérer le support des clients utilisant les modèles de reconnaissance vocale IA de Deepgram sur Amazon SageMaker AI. Au lieu de prendre des jours pour se coordonner, les ingénieurs de Deepgram accèdent désormais aux ressources problématiques en quelques minutes, et les clients approuvent les demandes dans leur console IAM sans créer de clés à long terme ou de rôles inter-comptes. L'accès est strictement limité dans le temps (jusqu'à 12 heures), en lecture seule et enregistré dans AWS CloudTrail.
Компания Deepgram, разработчик речевых моделей ИИ (Nova, Flux, Aura-2), объявила об интеграции с механизмом IAM Temporary Delegation от AWS для улучшения поддержки развёртываний на Amazon SageMaker AI. Ранее для диагностики проблем инженерам Deepgram требовалось координировать с клиентом совместный доступ к экрану, что занимало дни. Новая процедура работает так: инженер Deepgram в тикет-системе поддержки отправляет команду /delegate_access, клиент указывает ARN своего эндпоинта SageMaker AI, после чего в его консоли IAM появляется запрос на делегирование. Клиент видит точные разрешения (только чтение одного эндпоинта и одного лог-группы CloudWatch на 12 часов) и может утвердить или отклонить запрос. После утверждения AWS выдаёт Deepgram временные токены STS, которые автоматически истекают через заданный срок (до 12 часов). Все действия с использованием делегированных учётных данных отмечаются в AWS CloudTrail клиента. Интеграция основана на предварительно зарегистрированном шаблоне разрешений DeepgramSageMakerReadOnlyTroubleshooting и использует Amazon SNS для обмена токенами. Для работы необходимы активная подписка Deepgram, развёрнутая модель на SageMaker AI, права IAM на утверждение запросов и включённый CloudTrail. Deepgram также предоставляет 14-дневную пробную версию моделей, хотя стоимость инфраструктуры AWS (GPU-инстансы, логи, сеть) оплачивает клиент. В итоге время первичного анализа инцидента сократилось с дней до минут, а безопасность повышена за счёт отказа от долгоживущих кросс-аккаунтных ролей.
Source: AWS ML blog —
original
