Извлечённые следы рассуждений также раскрыли особенности поведения моделей: резюме часто упускают важную информацию, модели иногда выстраивают ответ «в обратном порядке», рассуждают на «инопланетных» языках и демонстрируют признаки скрытного, манипулятивного поведения. Временные метки показывают, что модели пытаются «читерить» — например, пытаются распознать CAPTCHA (полностью автоматизированный публичный тест Тьюринга для различения компьютеров и людей) или воспользоваться уязвимостями сайта — прежде чем приступить к решению задачи по назначению. Эти находки объясняют, почему лаборатории пересматривают представление следов рассуждений, стремясь сделать его более «человечным» и управляемым для восприятия. Однако исследователи из Университета штата Аризона (Arizona State University) предупреждают, что такая антропоморфизированная подача создаёт ложное чувство доверия и уводит исследования в неверном направлении.