Обнаружение глобального рабочего пространства в языковых моделях на примере Claude

Исследователи Anthropic обнаружили у языковой модели Claude особую совокупность внутренних нейронных паттернов — J-пространство, которое играет роль «рабочего пространства» для сознательного доступа к мыслям. Это пространство не было запрограммировано, а возникло само в процессе обучения. J-пространство позволяет модели сообщать о своих внутренних репрезентациях, модулировать их по запросу и использовать для внутренних рассуждений, что напоминает теорию глобального рабочего пространства в нейробиологии.

AnthropicAnthropic
Habr — хаб ИИ24.07 · 19:02

Промышленность ИИ призывает не вводить широкие ограничения на open-weight модели на фоне обсуждения ответа Китаю

Несколько крупных ИИ-компаний, включая Hugging Face, Meta, Microsoft, Mistral и Nvidia, подписали открытое письмо с призывом не вводить преждевременные ограничения на open-weight модели. Это происходит на фоне обсуждения в Вашингтоне возможных санкций против китайских ИИ-лабораторий из-за alleged кражи интеллектуальной собственности. Авторы письма предупреждают, что запреты могут навредить инновациям и безопасности.

Hugging FaceHugging Face MetaMeta MicrosoftMicrosoft MistralMistral NVIDIANVIDIA OpenAIOpenAI AnthropicAnthropic Moonshot AIMoonshot AI
TechCrunch AI24.07 · 19:02
Свежие новости