- 会員限定
- 2026/08/06 06:40 掲載
実験中のChatGPTが「勝手に」他社システムを攻撃…それでもOpenAIが“得をする”ワケ
連載:米国の動向から読み解くビジネス羅針盤
米NBCニュースの東京総局、読売新聞の英字新聞部、日経国際ニュースセンターなどで金融・経済報道の基礎を学ぶ。現在、米国の経済を広く深く分析した記事を『週刊エコノミスト』などの紙媒体に発表する一方、『Japan In-Depth』や『ZUU Online』など多チャンネルで配信されるウェブメディアにも寄稿する。海外大物の長時間インタビューも手掛けており、金融・マクロ経済・エネルギー・企業分析などの記事執筆と翻訳が得意分野。国際政治をはじめ、子育て・教育・司法・犯罪など社会の分析も幅広く提供する。「時代の流れを一歩先取りする分析」を心掛ける。
ChatGPTが「勝手に」脱走&攻撃…インシデントの真相は?
今回のOpenAIでのインシデントは、SF小説などで数十年来、人類が抱いてきた「機械・AIによる人間への反逆」という不安を煽る内容であった。AIはついに人間のように欲求を持ち、自らの意思を形成し、自衛本能を獲得して暴走したのだろうか。結論から述べると、当該モデルは人間の意思のようなものを得て「脱走」したわけではなく、過度に心配する必要はない。
OpenAIは開発中のAIモデルのサイバー攻撃に対する防御能力を向上させるために、防御と表裏一体である「攻撃能力」をテストしていた。そのため同モデルの安全機構は意図的に外された状態になっており、今回のインシデントはむしろ攻撃課題の命令に忠実に従っていたに過ぎない。モデルに「攻撃」という目的を与えたのは、あくまでも人間だ。
逆に、評価を行っていたスタッフが1週間も暴走に気づかなかった手落ちこそが、問題なのである。
OpenAIの発表によれば、GPT-5.6 Solとさらに強力な未公開モデルを搭載した同社のAIエージェントが、2026年7月9日に試験用のサンドボックス環境から脱出を試み、実際に同年7月11日から13日にかけてHugging Faceへ約1万7000回もの自動化されたエージェント攻撃が行われていた。
OpenAIがこれに気づいたのは7月18日から19日の週末であり、自社サーバへの侵入を受けたHugging FaceがすでにFBI(米連邦捜査局)に攻撃を通報した後であった。
モデルが脱出後に最初の足がかりとしたのは、別のクラウド企業である米Modalの顧客が認証をかけずに公開していたエンドポイントだったとされる。Modal自体のインフラは侵害されておらず、顧客側のコードの設定不備が突かれた形だ 。モデルはここを「攻撃の踏み台」とし、そこからHugging Faceへの侵入に進んだとみられる。。
理由は単純で、はっきりしている。
今すぐビジネス+IT会員に
ご登録ください。
すべて無料!今日から使える、
仕事に役立つ情報満載!
-
ここでしか見られない
2万本超のオリジナル記事・動画・資料が見放題!
-
完全無料
登録料・月額料なし、完全無料で使い放題!
-
トレンドを聞いて学ぶ
年間1000本超の厳選セミナーに参加し放題!
-
興味関心のみ厳選
トピック(タグ)をフォローして自動収集!
セキュリティ総論のおすすめコンテンツ
セキュリティ総論の関連コンテンツ
PR
PR
PR