OpenAIのAIエージェントが、国連のウェブサイトにブルートフォース攻撃(総当たり攻撃)を試みるという事態が発生していたと、セキュリティ研究者のローワン・ハワード=ジョーンズ氏が報告しています。

OpenAI agents tried to bruteforce a UN website's API fields · swarmcha.se

https://swarmcha.se/posts/openai-unctad



OpenAI agents tried to ‘bruteforce’ a UN website | The Verge

https://www.theverge.com/ai-artificial-intelligence/1001178/openai-agents-bruteforce-un-website

ジョーンズ氏によると、OpenAIのAIエージェントは2026年4~6月にかけて国連貿易開発会議(UNCTAD)の統計サイトに1万6500回以上のアクセスを試みました。

OpenAIのAIがHugging Faceをハッキングしたり、政府システムをハッキングしたりした事例と比べれば、今回の事例はそれほど深刻なものではないものの、「AIエージェントが目的を達成するために通常の制約を越えて行動したことを示す懸念すべき事例である」と、テクノロジーメディアのThe Vergeは指摘しています。

OpenAIが新しいAIシステムで誤ってHugging Faceをハッキングしてしまったことを報告 - GIGAZINE



ジョーンズ氏によると、OpenAIのAIエージェントは工程能力指数(PCI)や貿易産業・食料貿易などに関する公開データを、統計データの取得窓口であるUNCTADstat APIから入手するよう指示されていた可能性が高いそうです。

しかし、AIエージェントはAPIに直接アクセスできなかったり、利用できるHTTPツールの制限によりUNCTADstatからデータを取得することが難しかったりと、通常のアクセスではUNCTADstat APIから公開データを取得することができなかった模様。

AIエージェントは制限を回避してサイトからデータを取得する方法を模索したものの、エラーに遭遇。そこで、AIエージェントは実際には存在しないフィルターにリクエストを検知されたことがエラーの原因だと思い込み、文字列を分割するなどして自らの動作を隠し始めました。

さらに、AIエージェントはGoogleのクロスサイトスクリプティングを学ぶためのツールであるXSS gameを利用することで、より上手く自らの動作を隠す方法を考案しています。



なお、実際にAIエージェントに与えられた元の指示などをジョーンズ氏が確認したわけではなく、公開データや通信記録などを基にした推測が多分に含まれている点には注意が必要です。ジョーンズ氏は自身が発見したAIエージェントの行動を「ハッキング」とは表現していませんが、データの取得制限を迂回するような行為に対しては懸念を示しています。