Neptune для инференса LLM и графа знаний. Все AI-клиенты — как внутренние (например, Smart Assist), так и внешние (Amazon Quick, Claude Desktop) — используют единый MCP-сервер. С момента запуска Smartsheet сэкономил более 3 миллиардов токенов благодаря оптимизациям: прогрессивное раскрытие данных (ограничение токенов на ответ), строго типизированные схемы инструментов и проприетарный формат сериализации, снижающий потребление токенов на 35-47%. Система поддерживает три уровня контроля доступа: глобальное включение AI, ограничение только неразрушающими операциями и полный доступ на запись. Тестирование включает недетерминированные end-to-end сценарии с LLM в контуре, а развертывание выполняется с автоматическим откатом через ECS deployment circuit breakers. Для масштабирования AI-трафика используется ECS Auto Scaling с целевыми политиками, учитывающими объем трафика и загрузку CPU.