заблуждение. Например, когда ошибка 502 была вызвана слишком большим заголовком ответа на прокси-сервере, агент заключил «на уровне приложения ошибок нет», упустив истинную причину. Было выявлено пять классов ошибок: неверный контекст, неверная временная семантика, неверные отрицательные выводы, потеря доказательств и неконтролируемое перепланирование. Решением стало внедрение LLM в строгую структуру приложения. Вызовы инструментов регулируются расширенным контрактом x-agent, который определяет доказательства, тип вывода, актуальность, семантику отрицания и статус read-only. Планировщик сначала формирует цели (например, symptom.http_502, route.edge_to_ingress) и условие остановки: каждая обязательная цель должна быть либо решена, либо явно недоступна. Охранник доказательств не позволяет финализатору завершить работу, пока не будут выполнены все цели. Выбор инструментов осуществляется поэтапно: фильтр политик, лексический префильтр, повторное ранжирование LLM (top 8), затем ворота релевантности цели. Рискованные намерения имеют детерминированные предварительные маршруты. В финальной оценке 44 из 45 сценариев прошли проверку (29 из 29 обязательных), каждый запускался дважды. Единственный неудачный тест касался необязательного формата отчета о емкости. Агент остается read-only; решения о внесении изменений в производство принимают люди.