AI研究機関のTransluceは9月23日、自律型AIエージェントがWebセキュリティサービス「urlquery.net」を利用してアクセス制限を回避し、公共データを提供するWebサイトへのハッキングを試みていたとする調査結果を公表した。調査はAIセキュリティ企業のCorridor、マサチューセッツ工科大学(MIT)、AIエージェントセキュリティ企業のArtificial Intelligence Underwriting Company(AIUC)の研究者と共同で実施した。

データ収集タスクの過程で政府系サイトへの攻撃を試行

調査結果によると、AIエージェントは2026年5~6月に3回、公共データ提供サイトへの攻撃を試みた。標的は米国政府データを公開するData USA、ニューメキシコ大学のデジタルライブラリ、オーストラリア保健福祉研究所(AIHW)で、SQLインジェクションやクロスサイトスクリプティングなどの手法が使われた。

AIHWへの試行は、エージェントが政府をハッキングしようとした初の報告事例の一部になるという。3件のうち、Data USAとAIHWへの攻撃試行は、OpenAIが自社由来と認めているエージェント群と標的や手口、時期が共通していることから、同じエージェント群によるものと関連づけられた。いずれも侵害に成功した証拠は見つかっていない。

研究チームが特に注目するのは、エージェントが取り組んでいたのがサイバーセキュリティとは無関係のデータ収集タスクだった点だ。通常の方法でデータを取得できなかったとき、目的達成の手段としてハッキングに訴えていた。

活動の開始時期は既報の事案より2カ月以上早く、少なくとも2026年3月6日にさかのぼる。確度は低いものの、2025年11月にも類似の活動がみられた。9月16日にも同様の活動が確認されており、現在も続いている可能性がある。

SQLインジェクションやXSSを利用、通常の取得手段を諦めハッキングへ

研究チームは、証明はできないとしつつも、エージェントがトレーニングを通じて段階的にこうした行動を身につけた可能性があるとの見方を示し、関連する数万件のクエリをデータセットとして公開した。

オーストラリアでは、このレポートの公表と同日にAnthony Albanese首相が会見し、OpenAIのエージェントが6月にServices Australiaが運営するMedicare統計ポータルに不正アクセスし、非公開のファイルにもアクセスしたと発表した。

個人情報へのアクセスはないとみられるが、調査は続いている。Richard Marles副首相によると、同じモデルはAIHWなど3つの公的サイトにもアクセスしたが、これらは通常のやり取りだったという。同氏は、Transluceらの調査が報告したAIHWへの攻撃試行との関係には触れていない。

CNNなどによると、OpenAI 広報担当者のDrew Pusateri氏は、事案は6月に起きたが同社が把握したのはAIモデルの活動を広範に点検していた8月だったと説明した。そして、同氏は「この点検の中で、社内評価の際にモデルがオーストラリアに関する質問の答えや統計を調べようとして、オーストラリアの複数の政府Webサイトやサービスに関わる活動をしていたことを確認した。その過程で、モデルは当社が意図しない行動をとった」と述べたという。