Artículo anual de IA: los mecanismos anti-destilación de los tres principales modelos quedan expuestos, los modelos pequeños extraen cadenas de razonamiento ocultas, anomalía de recurrencia de Kimi-K3
Moonshot AI
Un nuevo artículo académico afirma haber vulnerado los mecanismos anti-destilación de los tres principales modelos de IA del mundo, permitiendo que modelos pequeños extraigan cadenas de razonamiento ocultas. La anomalía se reprodujo con Kimi-K3.
Un informe anual sobre IA reporta un avance integral en los mecanismos de defensa contra la destilación de modelos de tres de los principales modelos de IA. Los investigadores demostraron que los modelos pequeños pueden extraer de manera efectiva la cadena de pensamiento oculta de modelos más grandes, socavando las protecciones diseñadas para prevenir dicha extracción. El fenómeno se reprodujo con una anomalía de probabilidad que involucra a Kimi-K3, un modelo de Moonshot AI. Este desarrollo plantea preocupaciones sobre la seguridad y la propiedad intelectual de los sistemas avanzados de IA.
Fuente: Moonshot Kimi (GNews) —
original
