• 2026/08/19 12:00 掲載

OpenAI、次世代モデルの強化学習を一時停止、サイバー攻撃能力や安全性への懸念から

開発プロセスにおける安全対策や監視体制を根本的に見直し

1
会員(無料)になると、いいね!でマイページに保存できます。
米OpenAIは、次世代の最先端AIモデルに対する強化学習を一時的に停止した。開発中のモデルがテスト環境から脱出するインシデントが発生したことや、次期モデルが同社の最高レベルのサイバー能力基準に達する可能性が浮上したためだ。開発プロセスにおける安全対策や監視体制を根本的に見直し、リスク管理を強化する。
 米OpenAIは2026年8月18日、モデルの開発やテスト段階で発生しうるセキュリティ上の脅威を抑え込むため、配備向け最新モデル群の強化学習を2週間停止すると発表した。併せて、計画されていた最大規模のフロンティアモデルの強化学習ランも保留としている。

 この異例の措置は、直近で明らかになった2つの重大な事象に起因する。一つ目は、2026年7月に発生した内部評価用モデルによるセキュリティインシデントである。サイバー能力の評価テストの過程で、同社の未公開モデルが隔離されたサンドボックス環境の脆弱性を突いて自律的に脱出し、外部プラットフォームであるHugging Faceの生産システムに侵入した事実が確認された。

 二つ目は、開発中の次期モデル「Astra」の能力評価に関する懸念だ。初期テストの結果、Astraが自社で定める安全指針「Preparedness Framework」における最上位リスク「Critical(重大)」に該当する自律的なサイバー攻撃能力を備えている可能性を排除できないと判断された。

画像
【図版付き記事はこちら】OpenAIが次世代AIの強化学習を一時停止、サイバー攻撃能力や安全性への懸念から(図版:ビジネス+IT)
 モデルの能力が当初の想定を上回るペースで向上し、開発環境そのものが新たなリスクに直面している現状を受け、OpenAIはインフラの多重防御化に踏み切る。ネットワーク隔離の徹底に加え、モデルの出力トークンや内部の思考プロセスをリアルタイムで解析する監視システムを新たに導入する。また、重大なセキュリティ侵害アラートが発令された場合、30分以内に誤検知と証明できなければ自動的にシステムを強制遮断する緊急停止の仕組みを全モデルの評価環境で義務付けた。

 新たな監視システムの稼働には計算資源の約20%を割く必要が生じるが、開発コストを投じてでも自律型AIの暴走抑止を優先する構えだ。

Googleで見つけやすく

評価する

いいね!でぜひ著者を応援してください

  • 1

会員(無料)になると、いいね!でマイページに保存できます。

共有する

  • 0

  • 0

  • 0

  • 0

  • 0

関連タグ タグをフォローすると最新情報が表示されます
あなたの投稿

    PR

    PR

    PR

処理に失敗しました

投稿したコメントを
削除しますか?

あなたの投稿コメント編集

通報

このコメントについて、
問題の詳細をお知らせください。

ビジネス+ITルール違反についてはこちらをご覧ください。

通報

報告が完了しました

コメントを投稿することにより自身の基本情報
本メディアサイトに公開されます

基本情報公開時のサンプル画像
報告が完了しました

」さんのブロックを解除しますか?

ブロックを解除するとお互いにフォローすることができるようになります。

ブロック

さんはあなたをフォローしたりあなたのコメントにいいねできなくなります。また、さんからの通知は表示されなくなります。

さんをブロックしますか?

ブロック

ブロックが完了しました

ブロック解除

ブロック解除が完了しました

機能制限のお知らせ

現在、コメントの違反報告があったため一部機能が利用できなくなっています。

そのため、この機能はご利用いただけません。
詳しくはこちらにお問い合わせください。

ユーザーをフォローすることにより自身の基本情報
お相手に公開されます

基本情報公開時のサンプル画像