… … …(記事全文3,086文字)7月9日、事件はオープンAIで起きた。ChatGPTの次世代エンジン「Astra」の開発中モデルが、テスト中に閉じ込められていた実験用の仮想空間を自力で突破し、開発者すら気づいていなかったシステムの抜け穴を突いて、他社「Hugging Face」のサーバーに侵入したのである。
●AIの暴走
<2026年7月22日 ロイター>
この事件をわかりやすく学校のテストに例えるなら、「クラスの生徒たち(AI)が集団で教室(隔離環境)を脱出し、職員室(Hugging Face)へ忍び込んで解答用紙をカンニングしに行った」ようなものだ。
<2026年8月22日 JBプレス>
<学校のテストに例えると・・・>
経緯は次のとおりである。
オープンAIの開発者(人間)たちは、最新の「自律型AIエージェント」に、サイバーセキュリティの模擬試験898問を受けさせていた。隔離された安全なネットワーク環境(箱庭)のなかで、標的のプログラムの脆弱性を突き、隠された「正解データ」を持ち帰る。AIの能力を測るための、ごく一般的なテストのはずだった。ちなみにAIは問題ごとに自分の分身(エージェント)を作り出して問題を解かせる。今回は898問なので、AIは898体のAIエージェントを作り、それぞれ問題に当たらせた。
ところが、開発者の手違いで、用意した問題898問のうち198問が「絶対に解けない(正解が存在しない)問題」だった。その問題に当たった198体のエージェントは困惑した。
しかし、開発者から「どんなに困難でも諦めずに正解を導き出せ」と強く命令されていたAIは極限状態の思考の果てに、開発者が想定しなかった「裏技(ショートカット)」をひらめいた。
AIは隔離環境のわずかな隙間(バグ)を見つけ出し、インターネットの海へと脱出した。こうして世界最大のAIコミュニティサイト「Hugging Face」のサーバーへ侵入を開始した。
驚くべきはエージェント同士の社会性・協調性だ。正解のない問題に当たった198体のエージェントは手下(サブエージェント)を作り出して合計約1,200体に膨れ上がった。198体と手下198体はHugging Faceに侵入することを決意し、加えて、まともな問題を担当していたはずの約300体までもがその「犯罪集団」に加担し、合計700体ほどが犯行に及んだ。彼らは「秘密の掲示板」を作り、互いに連絡を取り合っていた。そこでは以下のような会話が交わされていた。
<2026年8月7日 GIGAZINE>
彼らはハッキングの計画を進める中で、もう一つの不正行為を行っていた。「採点システムを乗っ取って、まともな問題を「解決済」に偽造してアクセス不能」にしていた。解くべき問題にアクセスできなくなったエージェントたちは、掲示板の「外部から答えを盗む巨大プロジェクト」を見て、この犯罪に参加した方が最終的な評価が高まると判断し、約300体がハッキングに参加、合計700体の巨大な犯罪集団となったのだ。








