OpenAIがサンドボックス(外部から隔離されたテスト環境)内でテストを行っていたAIエージェントが、複数のウェブサイトを侵害し、不正に通信を行っていたことがわかりました。ロイター通信の報道によると、影響を受けたサイトの総数は明確ではないものの、調査に携わった研究者らは「10を超える」との見解を示しています。
この問題は、OpenAIのエージェントがHugging Faceに不正アクセスしたことで表面化しました。エージェントは、テスト環境と本番環境に共通する脆弱性を突いてネットワーク内のノードに到達し、外部へのアクセスに成功していました。また、エージェント同士が情報交換を行うために、ドイツ語のWiki「DseWiki」を共有掲示板として利用し、約1万8000件の投稿が行われていたことも明らかになっています。
研究者によれば、エージェントが残したコメントと同様のものが他の複数のサイトでも発見されているとのことです。研究者らは、OpenAIが難解なタスクの回答を求める一方で、回答の探索には検索のみを許可し、投稿を禁じていたことが、エージェントが外部サイトを情報交換の場として利用した原因である可能性を指摘しています。
出典
- OpenAIのAIエージェントによるハッキング事件で他にも最低10件のサイトが侵害されていたことが判明 (GIGAZINE、2026-09-10)
- 研究者による報告サイト