прошли проверку безопасности и используют формат SafeTensors. Модели развертываются с помощью шаблонов, определяющих среду выполнения (runtime), семейство ускорителей и длину контекста; среды включают vLLM, SGLang, TensorRT-LLM, NIM, TEI и llama.cpp. Процесс отбора включает идентификацию популярных моделей, проверку соответствия требованиям и безопасности, сборку и сканирование образов сред выполнения, загрузку весов в хранилище Azure, а также проверку соответствия API и производительности перед публикацией в каталоге моделей Foundry. Управление развертыванием осуществляется Microsoft, с автоматическим обновлением контейнеров, обновлением сред выполнения и установкой исправлений безопасности. Сервис поддерживает глобальное и региональное развертывание, а также позволяет комбинировать открытые и передовые модели в рамках одного агента. Партнерство направлено на устранение разрыва между гибкостью открытых моделей и эксплуатационными потребностями предприятий.