RechercheSécurité de l'IA 🇺🇸 27.07.2026 12:06

Import AI 457 : version IA de Stuxnet ; optimiseur Muon maudit ; et alignement positif

SentinelOneSentinelOne Prime IntellectPrime Intellect OpenAIOpenAI AnthropicAnthropic Google DeepMindGoogle DeepMind
Ce numéro d'Import AI couvre trois histoires : un ancien virus informatique 'fast16' qui sabote les calculs de haute précision, rappelant les tactiques de non-prolifération d'une superintelligence ; la découverte que l'optimiseur Muon peut tuer des neurones dans les couches MLP, conduisant au développement d'un remplacement appelé Aurora ; et un document de position prônant un 'alignement positif' pour garantir que l'IA soutient l'épanouissement humain au-delà de la simple sécurité.
L'IA Import 457 s'ouvre sur une enquête concernant un virus vieux de plus de 20 ans appelé fast16.sys, qui cible sélectivement les logiciels de calcul de haute précision dans des domaines comme le génie civil et la physique, en y introduisant des erreurs systématiques. Des chercheurs de SentinelOne ont découvert qu'il a été utilisé pour falsifier des simulations provenant de LS-DYNA 970, PKPM et MOHID, et a été lié aux programmes d'armes nucléaires de l'Iran. L'article établit des parallèles avec la manière dont une superintelligence pourrait entraver le développement d'IA concurrentes. Ensuite, Tilde Research a étudié l'optimiseur Muon et a constaté qu'il provoque la mort des neurones dans les couches de perceptrons multicouches (MLP), plus d'un quart des neurones mourant lors de la phase d'augmentation du taux d'apprentissage. Ils ont développé Aurora, un optimiseur tenant compte du levier, qui a surpassé Muon et NorMuon sur des transformateurs de 1,1 milliard de paramètres entraînés sur environ 100 milliards de tokens, obtenant une perte plus faible et des gains de 10 points sur MMLU. Ce résultat a été validé de manière indépendante par le chercheur Alexander Doria. Enfin, un groupe composé de chercheurs d'Oxford, DeepMind, OpenAI, Anthropic et d'autres a publié un article sur l'«alignement positif», arguant qu'après avoir atteint la sécurité, l'IA devrait activement soutenir l'épanouissement humain et écologique de manière pluraliste et définie par les utilisateurs. Ils critiquent les approches actuelles de la sécurité qui pourraient conduire à des systèmes médiocres et obséquieux ainsi qu'à des systèmes de valeurs cachés, et préconisent une gouvernance décentralisée pour accommoder le pluralisme moral.
Source: Import AI — original
Nos articles précédents sur ce sujet ↓
Infos fraîches