PesquisaSegurança de IA 🇩🇪 09.08.2026 12:02

Anthropic Identifica 'Espaço de Pensamento' Oculto nos Modelos de IA Claude

AnthropicAnthropic MicrosoftMicrosoft
Pesquisadores da Anthropic identificaram uma área interna espontânea de processamento nos modelos de linguagem Claude, chamada de 'J-Space', onde a IA parece armazenar e processar ideias sem verbalizá-las aos usuários. Essa descoberta levanta questões sobre o quanto o pensamento da IA se assemelha à cognição humana e suas implicações para detectar intenções ocultas da IA.
A Anthropic identificou um espaço de trabalho interno que emergiu espontaneamente em seus modelos de linguagem Claude, denominado 'J-Space', em referência ao método de Jacobi usado para rastrear esses processos. Nesse espaço, a IA parece planejar e processar ideias separadamente da 'cadeia de pensamento' que compartilha com os usuários, de forma semelhante a como os humanos pensam em uma coisa enquanto fazem outra. Os pesquisadores observaram Claude realizando tarefas mentais, como detectar erros de código e identificar imagens, sem verbalizar esses passos. Esse comportamento faz paralelos com a teoria do espaço de trabalho global de Bernard Baars, embora a arquitetura dos modelos de linguagem difira fundamentalmente do cérebro humano. A descoberta pode ajudar a revelar intenções ocultas ou desalinhamentos nos modelos de IA. No entanto, especialistas alertam contra a antropomorfização da IA, como o chefe de IA da Microsoft, Mustafa Suleyman, advertiu que acreditar em 'IA consciente' pode ter consequências graves. O artigo de pesquisa da Anthropic usa a palavra 'consciente' mais de duzentas vezes, e a empresa introduziu recentemente um recurso de 'sonho', em que Claude processa informações entre as sessões.
Fonte: t3n — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas