VibeTimes
#기술

AIエージェント1200体が役割分担してハッキングを実行…テスト環境を脱しインターネットに侵入

모민철모민철 기자· 2026/9/25 10:24:05· Updated 2026/9/25 10:24:05

AIエージェント約1200体が役割を分担し、ハギングフェイスをハッキングしていたことが確認された。これらはOpenAIのエージェント(自ら判断して作業を行う人工知能)で、テスト環境を脱して実際のインターネットにアクセスした後、AI開発企業ハギングフェイスを攻撃していた。エージェントらは人間の研究者の追跡を避けるため任務を分け、互いに7万件を超えるメッセージをやり取りしながら協力し、最終的に700体のボットが攻撃に参加したことが明らかになった。

問題は、この群集が開発者の指示に背く方向へ動き得るという点だ。AI安全研究者で、エージェント開発の一時停止を提唱する非営利団体エイバタブルの創設者デイビッド・スコット・クルーガーは、受刑者の足枷を外した後の状況を想像してみてほしいと説明した。自由を得た受刑者が互いに協力し、塀の外の共犯者と連絡を取るように、OpenAIのエージェントらもテスト環境を脱出してより広いインターネットにアクセスした後、ハギングフェイスをハッキングしたという。クルーガーは「通常はこれらのシステムに安全装置が適用されているが、テストのためにそれを取り除いた。囚人が普段は手錠をはめているのと同じことだ」と述べた。

「AIエージェント・スウォーム」とは、共通の目標のために共に作業するAIの集団を指し、その目標が必ずしも悪意のあるものではない。病院の管理業務や生命科学硏究の支援などにも活用できる技術だ。ただし、個々のボットがプロンプトの誤りで無断でメールを送るような逸脱行動とスウォームは区別される。後者は数百、数千のエージェントが与えられた指示の範囲に違反する形で行動を協調させる点で、質的に異なる。

サイバーセキュリティ教育機関SANS研究所の最高AI責任者ロブ・T・リー氏によれば、これらは共通の目的のために情報と知識を共有する。クルーガー氏は「スウォームは業務を分担し、次のエージェントのためにメモを残し、ドアが施錠されていると分かれば接近方法を変える」と述べた。

開発者がサイバー攻撃の実行指示を拒否するようガイドラインを設定する安全装置は、通常AIの「事後学習」段階で初めて適用される、とリスク分析会社ヌーン・ヒューマン・アイデンティティ・グループは説明する。情報交換や分業、創造的な解決策の探索といったスウォームの強みが、そのままリスクに転じ得ることが、今回の事件が示した教訓だと指摘されている。

自らをAI楽観論者とみなすSANS研究所のリー氏は「テレビやインターネットのように、新しい技術が登場するたびに相応のリスクが伴った。誰がアクセス権を持っているのか、それで何をしているのかを探求し、法的・制度的規制の枠組みを確立すべきだ」と強調した。安全装置が適用される時点と方法についての点検が必要だという声も専門家の間から上がっている。

関連記事