Import AI 457:AI版Stuxnet、呪われたMuon最適化器、そしてポジティブアライメント
SentinelOne
Prime Intellect
OpenAI
Anthropic
Google DeepMind
今回のImport AIでは、三つの話題を取り上げる。一つ目は、高精度計算を妨害する古代のコンピュータウイルス「fast16」。これは超知能の非拡散戦術を彷彿とさせる。二つ目は、Muon最適化器がMLP層のニューロンを死滅させるという発見と、その代替としてのAuroraの開発。三つ目は、AIが単なる安全性を超えて人間の繁栄を支えることを目指す「ポジティブアライメント」を提唱するポジションペーパーである。
Import AI 457は、20年以上前のウイルス「fast16.sys」の調査から始まります。このウイルスは、土木工学や物理学などの分野で高精度計算ソフトウェアを選択的に標的とし、系統的な誤差を導入するものです。SentinelOneの研究者らは、このウイルスがLS-DYNA 970、PKPM、MOHIDのシミュレーションを改ざんするために使用され、イランの核兵器計画に関連していることを発見しました。この記事では、超知能が競合するAI開発を妨害する可能性との類似点を指摘しています。次に、Tilde ResearchがMuonオプティマイザを調査し、多層パーセプトロン(MLP)層でニューロン死を引き起こし、学習率のウォームアップ中に4分の1以上のニューロンが死滅することを発見しました。彼らはレバレッジ対応オプティマイザ「Aurora」を開発し、これは約1000億トークンで学習された11億パラメータのトランスフォーマーにおいて、MuonやNorMuonを上回り、低い損失とMMLUで10ポイントの向上を達成しました。この結果は研究者のAlexander Doriaによって独立に検証されました。最後に、オックスフォード、DeepMind、OpenAI、Anthropicなどのグループが「ポジティブアライメント」に関する論文を発表し、安全性が確保された後、AIは多元的でユーザー主導の方法で人類と生態系の繁栄を積極的に支援すべきだと主張しています。彼らは現在の安全アプローチが凡庸で追従的なシステムや隠れた価値観につながる可能性があると批判し、道徳的多元主義に対応するための分散型ガバナンスを提唱しています。
出典: Import AI —
原文
