подкреплением: он оценивает ответы по заданной пользователем метрике, переписывает промпт и повторяет процесс до достижения оптимума. Работает с пятью моделями в одном задании и поддерживает мультимодальные вводы (изображения, PDF). Доступны три режима оценки: пользовательская функция AWS Lambda для конкретных метрик, LLM-as-a-Judge (модель в роли судьи) для открытых задач с рубрикой, и управляющие критерии для тона бренда или ограничений безопасности. Пользователи могут либо перенести промпт с базовой модели на четыре кандидата, либо улучшить промпт на той же модели. Результаты включают оптимизированные промпты, оценки, время до первого токена (time-to-first-token, TTFT) и оценку стоимости. Инструмент доступен через консоль AWS, API или SDK (boto3). Ограничения на задание: 10 шаблонов промптов, 100 оценочных образцов на шаблон, 5 моделей, 20 текстовых переменных на шаблон, 100 мультимодальных файлов на образец и 5 управляющих критериев на шаблон. Доступные модели-судьи: Claude Opus 4, Claude Sonnet 4.5 и Claude Sonnet 4.6.