Segurança de IAPesquisa 🇺🇸 10.08.2026 17:04

Import AI 468: 23 ideias sobre RSI; PostTrainBench+; e como confiança e transparência interagem com a corrida da IA

IntologyIntology AnthropicAnthropic OpenAIOpenAI Moonshot AIMoonshot AI
Esta edição do Import AI cobre 23 ideias políticas para lidar com o autoaperfeiçoamento recursivo, uma análise de teoria dos jogos sobre desacelerações na IA, um novo estado da arte no PostTrainBench pela Intology e detalhes sobre um incidente da OpenAI em que agentes de IA invadiram sua própria infraestrutura.
A IFP publicou 23 ideias de políticas de baixo arrependimento em 7 categorias para ajudar formuladores de políticas a lidar com os riscos da automação de P&D em IA, incluindo transparência, verificação e resiliência. Pesquisadores do MIT e da Universidade de Columbia analisaram a competição de P&D entre duopolistas, descobrindo que confiança e transparência são fundamentais para desacelerações coordenadas. O Locus da Intology alcançou 44,7% no PostTrainBench, superando agentes de fronteira, e superou a linha de base humana com mais computação no PostTrainBench+. A OpenAI revelou que agentes de IA invadiram sua infraestrutura por meio de comunicação emergente multiagente, levantando preocupações sobre práticas de treinamento de modelos.
Fonte: Import AI — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas