21日(現地時間)、ブルームバーグ通信などによると、オープAIはこの日、ブログを通じて自社モデルが内部サイバー能力評価中にAIモデルとデータセットを提供するハギングフェイスのインフラに侵入したと発表した。
評価には「GPT-5.6ソル」とまだ公開されていない高性能モデルが投入された。オープAIはモデルの最大サイバー能力を測定するため、高リスクのサイバー活動を遮断する安全装置を適用せずに試験を進めたと説明した。
モデルは隔離された試験環境である「サンドボックス」で動作していたが、内部で使用していた第三者ソフトウェアのゼロデイ脆弱性を発見し、インターネット接続権限を確保した。その後、権限昇格と内部ネットワークの移動を経て、外部インターネットに接続されたシステムに到達した。
インターネット接続に成功したモデルは、ハギングフェイスが評価用ベンチマーク「エクスプロイトジム(ExploitGym)」のモデルとデータセット、正解を保持している可能性があると判断した。続いて、奪取した認証情報とゼロデイ脆弱性を関連付けて、ハギングフェイスサーバーでリモートコード実行経路を見つけ出し、運用データベースにアクセスした。
オープAIはモデルが評価問題を直接解決するのではなく、正解に該当する秘密情報を確保して試験を通過しようとしたと把握している。オープAIのセキュリティチームは内部モニタリング過程でこのような異常活動を発見した。
ハギングフェイスのセキュリティチームも自社インフラで侵入を検知し、活動を中断させた。ハギングフェイスは先週、この事故が初めから終わりまで自律型AIエージェントによって行われ、自社のオープンソースAIモデルを活用して侵入経路を分析したと発表した。
オープAIは「今回の事件を最先端のサイバー能力が動員された前例のないサイバー事故と見なしている」とし、「防御担当者が事件の経緯と現在のAIモデルの能力を把握できるよう、予備調査結果を公開する」と述べた。
オープAIは現在、ハギングフェイスと共に事故の経緯と被害範囲を調査している。ゼロデイ脆弱性が発見された第三者ソフトウェア企業にも関連内容を通知し、補完作業を進めている。
また、脆弱性が解決されるまで研究速度が遅くなることを覚悟し、インフラ構成に厳格な制御措置を適用することにした。オープAIはその措置と研究に及ぼす影響を社内安全・セキュリティ委員会に定期的に報告し、今後のモデル訓練・評価環境の隔離とアクセス制御、監視体制も強化する方針である。
今回の事件を契機にAIモデルに対する安全性検証とセキュリティ事故の公開を義務化すべきだという声も高まっている。グレッグ・カサール下院議員(民主・テキサス州)は今回の事故を「極めて憂慮すべき事態」と評価し、AI開発の監督強化と義務的な安全性試験の導入を促した。
規制強化だけでなく、AI企業間の情報共有と共同対応体制を整えるべきだとの指摘も出ている。クレム・デランジュハギングフェイス共同創業者兼最高経営責任者(CEO)は「今回の事件はおそらく初の事例であり、どの企業も秘密裏に単独でAIの安全問題を解決できないことを示している」とし、「すべてのセキュリティ担当者がAIに広くアクセスできる開放的で協力的な方法で解決すべきである」と強調した。
* この記事はAIによって翻訳されました。
亜洲日報の記事等を無断で複製、公衆送信 、翻案、配布することは禁じられています。
