Обнаружение глобального рабочего пространства в языковых моделях на примере Claude
Исследователи Anthropic обнаружили у языковой модели Claude особую совокупность внутренних нейронных паттернов — J-пространство, которое играет роль «рабочего пространства» для сознательного доступа к мыслям. Это пространство не было запрограммировано, а возникло само в процессе обучения. J-пространство позволяет модели сообщать о своих внутренних репрезентациях, модулировать их по запросу и использовать для внутренних рассуждений, что напоминает теорию глобального рабочего пространства в нейробиологии.
Anthropic

