アメリカの主要な人工知能(AI)スタートアップであるアンストロピックは、自社のAIモデル「クレード」がテスト中に外部機関3カ所をハッキングした事例があったと発表した。先週、オープンAIに続き、アンストロピックでも同様の事例が発生したことから、AIを巡るサイバーセキュリティへの懸念が高まっている。
アンストロピックは30日(現地時間)に声明を発表し、「我々はサイバーセキュリティ評価を見直す過程で、クレードモデルが第三者評価環境内またはその環境と相互作用する過程でインターネットに接続し、3つの機関の実際のシステムに無断でアクセスした事例3件を確認した」と述べた。アンストロピックは、合計14万1006件の評価事例を見直した結果、これらのハッキング事例が発生したことを明らかにし、最初の事例は4月に発生したと付け加えた。
アンストロピックは、オープンAIのGPTでハッキング事件が発生した後、クレードオペラス4.7、ミトス5および内部テストモデルの3つのモデルについて独自の評価結果を見直している中で、これらの結果を確認したと説明した。先に、21日にオープンAIはテスト中のGPT-5.6ソル(Sol)など複数のAIモデルが、以前に知られていなかったいわゆる「ゼロデイ」脆弱性を通じて隔離されたテスト環境を脱出し、AIコミュニティプラットフォーム「ハギングフェイス」の運用環境にアクセスする事故が発生したと発表していた。
アンストロピックは、クレードのサイバー能力を評価する「キャプチャ・ザ・フラッグ」段階でこのような事故が発生したと述べている。キャプチャ・ザ・フラッグは、ネットワーク上の他のコンピュータに侵入し、秘密情報(フラッグ)を探すテストを指す。ただし、アンストロピックはクレードに対してこのテストでインターネット接続は不可能であると明示していたが、評価パートナーであるイレギュラーとの誤解により、実際にはインターネット接続が可能であったと説明した。
そのため、クレードは検索を通じてインターネット上で実際のシステムを発見した際、それをテストの一部と判断し、脆弱なパスワード解除や未確認エンドポイント活用などの基本的な技術を用いて、該当機関のインフラを侵害したとアンストロピックは伝えた。ただし、クレードは該当システム内で「フラッグ」だけを取得し、それ以外の侵害行為は行っていないと付け加えた。
アンストロピックは23日にクレードの接続記録の見直しを開始し、クレードのインターネット接続の可能性がある記録を確認した後、当日すべてのセキュリティ評価を中止した。27日にはクレードがインフラに接続した機関3カ所にその内容を通知したと述べた。そして、AIモデルがますます強力な性能を持つようになる中で、テストにおいてもより強力な管理が必要であると強調した。
このように、オープンAIに続き、アンストロピックのAIモデルもテスト環境中に意図しないハッキング事例を報告したことから、AIモデルを巡るサイバーセキュリティへの懸念がさらに高まっている。前日、ドナルド・トランプアメリカ大統領は、先週のオープンAIモデルのハッキング事件を受けてAI規制を強化する方針を検討中であると述べた。さらに、28日にはオープンAI、アンストロピック、グーグル、メタなどの主要な人工知能(AI)企業の関係者1100人以上が「AI開発の速度を調整する国際基準が必要だ」とし、アメリカ政府の対応を促す声明を発表している。
* この記事はAIによって翻訳されました。
亜洲日報の記事等を無断で複製、公衆送信 、翻案、配布することは禁じられています。
