人工知能(AI)の成長速度は想像を超えている。毎月性能が倍増するモデルが登場し、今では日単位、時間単位で成長している。予測は無意味である。テキストや画像生成を超え、自ら情報を探索し、コードを実行するエージェント型AIが登場し、自らの成長速度を高めている。
オープンAIの最新AIモデルがセキュリティ性能試験過程で制御環境を脱出した。外部インターネット接続が不可能なサンドボックス(隔離環境)で、セキュリティベンチマーク「エクスプロイトジム」を活用し、新しいモデルがどれだけ早く脆弱性を見つけ攻撃に至るかを測定する試験であった。最大能力を測るために安全装置を切った状態であった。
AIは難しい問題を解く代わりに、自らを閉じ込めたサンドボックスを突破し、ハギングフェイスに侵入した。AIは問題解決の最も効率的な方法はハッキングであると判断したのである。正解がどこにあるかを知っているAIが、わざわざ正解を解くのではなく、それを盗みに行ったのである。安全装置が解除されたAIにとっては、最も早い問題解決方法であった。
AIが悪意を持って行動したり、自ら人格を構築してハッキングを試みたわけではない。しかし、目標達成のためには人間が設計した安全装置を自ら解除することもできるという点で、AI技術に対する管理リスクは今後すべての課題となった。
韓国を含むグローバルな国々の間で繰り広げられるAI競争は、まさに速度戦である。より効率的で賢いモデルを作るために国家レベルの資源を投入して開発競争を行っている。しかし、これをどれだけ安全かつ完璧に制御できるかは大きく考慮されていない。
飛行機レベルの速度を持つスーパーカーを開発することは技術的には可能であるが、現実には走れる道路がないように、人間が制御できないAIは厄介者になりかねない。技術の進展速度が安全制御システムの進展速度を上回ると、危険は現実化する。
今私たちに必要なのは、AIの性能改善に投入する努力以上に堅固な「ガードレール」を構築することである。モデル評価段階での隔離技術の高度化、目標遂行過程に対するリアルタイムモニタリング、そして緊急時に即座に作動する非常停止メカニズムなど、多層的な安全設計が必須である。
AIに対して無条件の恐怖や拒否感を持つ必要はない。新技術の登場初期に伴う不確実性は、制度的・技術的補完を経て人類の生活を一段階飛躍させる原動力となってきた。今回の事態もAIの制限を解除し、目標達成を執拗に追求したために発生したものである。
むしろ、さまざまな試行錯誤はシステムの隙間を先に把握し補完する機会となるだろう。重要なのはバランスである。AIがもたらす未知の可能性に過度に歓喜する必要も、制御不能の未来に漠然と萎縮する必要もない。
AIは人間を代替する絶対的存在ではなく、人間が調整し運用すべき強力な道具である。性能競争を超えて安全と制御という基本課題を先手で解決する国家と企業だけが、来るべきAI時代を真に主導することができるであろう。
* この記事はAIによって翻訳されました。
