Anthropic・OpenAI・GoogleのAPIを用いてコールセンターや社内業務の自動化などのAIサービスを構築している企業の推論ログから、個人情報が漏洩する可能性があるとの研究結果が発表された。
12日にHugging Faceに掲載された論文『独占LLM APIから推論の痕跡を盗む』によれば、Anthropic・OpenAI・Googleの3社のフロンティアモデルにおいて、クライアントに返される『暗号化推論』ブロックに構造的欠陥が見つかった。
暗号化推論とは、AIモデルが最終的な回答を出す前に内部で行う思考過程をそのまま露出せず、暗号化した形でクライアントに伝える方式である。競合他社がこの過程を覗き見て自社モデルを訓練(蒸留)するのを防ぎ、安全装置を回避する思考過程がユーザーにそのまま露出するのを防ぐために、3社すべてが導入している。
問題は、この暗号化ブロックが同じAIモデル内で相互に互換性があることである。上位モデルが暗号化したブロックを下位モデルで解除を要求すると、平文で解読される。論文は、AnthropicのClaude Opus 4.8が生成した暗号化ブロックを相対的に弱いClaude Haiku 4.5で解読した実験によってこれを証明した。OpenAIのGPT系列やGoogleのGemini系列でも同様の構造的欠陥が確認された。
研究チームは、公開リポジトリにアップロードされた実際のエージェントの動作記録6708件から、推論ブロック31万5320個の暗号を解読した。ここから367件の個人情報(PII)と182件のAPIキー・パスワードなどの認証情報が確認された。公開リポジトリに存在するログから実際に抽出されたデータであることから、波紋が予想される。
3社のAPIを導入した国内企業も個人情報漏洩のリスクにさらされる可能性がある。国内のAIサービス企業の多くは、Anthropic・OpenAI・GoogleのAPIをコールセンターの相談や社内業務の自動化に連携して活用している。
Samsung Electronicsは、ChatGPTベースのAPIをソフトウェア開発・製品開発・マーケティングなどの業務全般に導入している。LG Electronics・LG CNS・Samsung SDS・Krafton・TossなどもChatGPTベースのAPIを社内業務の自動化に活用している。Shinhan Bankなど金融業界もAIコンタクトセンター(AICC)でコールセンターの相談を自動化する傾向にある。
特に、対話の文脈を維持する必要があるマルチターンチャットボットや複数のステップを経て作業を行うエージェント型サービスは、構造上暗号化推論ブロックをセッションごとにやり取りせざるを得ないため、今回の脆弱性に大きくさらされている。セッションログの保存・共有の有無についての点検とともに、関連部門の対応策の策定が必要であるとの指摘がなされている。
* この記事はAIによって翻訳されました。
亜洲日報の記事等を無断で複製、公衆送信 、翻案、配布することは禁じられています。
