Artigo Anual de IA: Mecanismos de Antidestilação dos Três Principais Modelos Quebrados, Modelos Pequenos Extraem Cadeias de Raciocínio Ocultas, Anomalia de Recorrência do Kimi-K3
Moonshot AI
Um novo artigo acadêmico afirma ter quebrado os mecanismos de antidestilação dos três principais modelos de IA do mundo, permitindo que modelos pequenos extraiam cadeias de raciocínio ocultas. A anomalia foi reproduzida com o Kimi-K3.
Um relatório anual sobre IA reporta um avanço abrangente nos mecanismos de defesa contra a destilação de modelos de três modelos de IA líderes. Os pesquisadores demonstraram que modelos pequenos podem extrair efetivamente a cadeia de pensamento oculta de modelos maiores, minando as proteções projetadas para evitar tal extração. O fenômeno foi reproduzido com uma anomalia de probabilidade envolvendo o Kimi-K3, um modelo da Moonshot AI. Esse desenvolvimento levanta preocupações sobre a segurança e a propriedade intelectual de sistemas avançados de IA.
Fonte: Moonshot Kimi (GNews) —
original
