уникальным идентификатором трассировки, измерять метрики на уровне агента, такие как точность выбора инструмента и процент завершения целей, оценивать выборку ответов с помощью LLM-as-judge (большая языковая модель в роли судьи), версионировать промпты в Git и отправлять телеметрию в два назначения (например, облачного провайдера и специализированные инструменты), чтобы избежать привязки к поставщику. Эти практики крайне важны даже до появления специализированных инструментов наблюдаемости для агентов.