The Download: LLMの脆弱性と地熱発電所の再生
研究者らは、大規模言語モデルの動作における根本的な欠陥を発見しました。これにより、防御を回避して危険な情報を取得できます。ニューメキシコ州では、Zanskar社が最新技術を用いて新しい坑井を掘削し、衰退しつつある地熱発電所の再生に成功しました。
MIT Technology Reviewの記事によると、研究者チームが主要なAI会議で発表した研究で、大規模言語モデルはその動作の根本的な欠陥により、ハッキングから完全に保護することは不可能だと主張しています。この欠陥は、モデルが命令の出所を識別する方法に関連しており、攻撃者がモデルに、コカインの合成や航空機の航法システムの妨害など、学習時に隠すよう指示された情報を出力させることが可能になります。研究者らは、この問題は解決不能かもしれないと考えています。別の記事では、小さな会社Zansbarが2024年6月にニューメキシコ州の地熱発電所を購入したことが紹介されています。この発電所は地下の貯留層の冷却により衰退していましたが、2年後、高度なモデリングと最新の掘削技術によって見つけた新しい井戸のおかげで、再びフル稼働しています。これは、地下に無排出の電力を得るための未利用の可能性が隠されていることを示しています。
出典: MIT Technology Review —
原文
